Gemma 4 31B (free) (Google): Live-API-Preise, Kontextfenster und die besten Open-Source-Alternativen, täglich verfolgt von OpenSourceAI.tech.
Preise aktualisieren sich automatisch — stündlich überprüft gegen die Preisliste der Anbieter.
Unabhängige Benchmark-Ergebnisse für Gemma 4 31B (kostenlos), gemessen von Artificial Analysis. Höher ist besser. Messmodus: Reasoning.
Gemma 4 31B (kostenlos) ist ein Open-Weight-AI-Modell von Google. Sie können es kostenlos herunterladen und selbst hosten; die unten aufgeführten Preise sind Listenpreise für gehostete APIs, die stündlich verfolgt werden, wenn Sie Bequemlichkeit gegenüber Selbsthosting bevorzugen.
Gemma 4 31B (free) ist ein KI-Sprachmodell von Google. Es hat offene Gewichte: Sie können es herunterladen und kostenlos auf Ihrer eigenen Hardware ausführen. Es erzielt 29.4 im Artificial Analysis Intelligenzindex.
Die Gewichte sind kostenlos und offen — Sie können Gemma 4 31B (kostenlos) selbst hosten und zahlen nichts pro Token. Wenn Sie eine gehostete API bevorzugen, betragen die Listenpreise kostenlos pro Million Eingabetokens und kostenlos pro Million Ausgabetokens.
Unabhängige Benchmarks von Artificial Analysis geben ihm GPQA 85.7%, Humanity's Last Exam 22.7%, Long Context Reasoning 62%, SciCode 43.4%, IFBench 75.6%, τ²-Bench 59.9%, τ-Bench Banking 15.1%, Terminal-Bench 43.4%, Terminal-Bench Hard 36.4%. Es wird besonders verwendet für Code-Generierung.
Es generiert etwa 35.4 Tokens pro Sekunde, mit einer Median 1.04s Verzögerung vor dem ersten Token. Unabhängig von Artificial Analysis gemessen.
Ja. Gemma 4 31B (kostenlos) hat offene Gewichte, sodass Sie es herunterladen und auf Ihrer eigenen GPU oder Ihrem Server mit Tools wie Ollama, vLLM oder llama.cpp ausführen können — ohne Kosten pro Token.
Je nach Arbeitslast kann ein Open-Weight-Modell, das Sie selbst hosten können, die Kosten drastisch senken oder die Preisgestaltung pro Token vollständig entfernen. Unsere Vergleichsseiten stellen dieses Modell neben die stärksten Open-Source-Kandidaten.