Google · alle Modelle ›

GGemma 4 31BOPEN

Gemma 4 31B Instruct ist Googles DeepMinds 30.7B dichtes multimodales Modell, das Text- und Bildeingaben mit Textausgaben unterstützt.

262KKontextfenster · Tokens
$0.09Eingabepreis · pro M Tokens
$0.34Ausgabepreis · pro M Tokens
GoogleAnbieter

Preise werden automatisch aktualisiert — täglich geprüft anhand der Listenpreise der Anbieter.

Siehe Modellvergleiche → Vergleiche alle Modellpreise

Benchmarks & Leistung

Unabhängige Benchmark-Ergebnisse für Gemma 4 31B, gemessen von Artificial Analysis. Höher ist besser. Messmodus: Reasoning.

Intelligence index29.7
Coding index43.4
GPQA85.7%
Humanity's Last Exam23.6%
Long Context Reasoning68.3%
SciCode43.4%
IFBench75.6%
τ²-Bench59.9%
τ-Bench Banking14.8%
Terminal-Bench43.4%
Terminal-Bench Hard36.4%
⚡ Speed35.6 tokens/sec
⏱ Latency0.92s to first token
vs. Modelle, die hier gemessen werdenoberste 50%
Scores höher als 50% der 273 Modelle, die von Artificial Analysis gemessen und hier verfolgt werden.
Modelle auf diesem Niveau kosten $1 pro 1M Tokens (Median von 14) — dieses kostet $0.15.
Günstiger und besser in diesem Index: GLM 5.3 Flash · DeepSeek V4 Flash 0731 · DeepSeek V4 Flash 0423 und 3 mehr
Benchmark-Daten von Artificial Analysis

Über dieses Modell

Gemma 4 31B ist ein open-weight KI-Modell von Google. Sie können es kostenlos herunterladen und self-hosted betreiben; die unten aufgeführten Preise sind die Listenpreise der gehosteten API, die täglich aktualisiert werden, für den Fall, dass Sie den Komfort dem Self-Hosting vorziehen.

Häufig gestellte Fragen

Was ist Gemma 4 31B?

Gemma 4 31B ist ein KI-Sprachmodell von Google. Es ist open-weight: Sie können es herunterladen und auf Ihrer eigenen Hardware kostenlos ausführen. Es erzielt 29.7 im Artificial Analysis Intelligenzindex.

Ist Gemma 4 31B kostenlos?

Die Gewichte sind frei und offen – Sie können Gemma 4 31B selbst hosten und nichts pro Token bezahlen. Wenn Sie eine gehostete API bevorzugen, liegen die Listenpreise bei 0,09 $ pro Million Eingabe-Tokens und 0,34 $ pro Million Ausgabe-Tokens.

Wofür ist Gemma 4 31B gut?

Unabhängige Benchmarks von Artificial Analysis geben ihm GPQA 85.7%, Humanity's Last Exam 23.6%, Long Context Reasoning 68.3%, SciCode 43.4%, IFBench 75.6%, τ²-Bench 59.9%, τ-Bench Banking 14.8%, Terminal-Bench 43.4%, Terminal-Bench Hard 36.4%. Es wird besonders verwendet für Code-Generierung.

Wie schnell ist Gemma 4 31B?

Es generiert etwa 35.6 Tokens pro Sekunde, mit einer Median 0.92s Verzögerung vor dem ersten Token. Unabhängig von Artificial Analysis gemessen.

Kann ich Gemma 4 31B selbst hosten?

Ja. Gemma 4 31B hat open weights, sodass Sie es herunterladen und auf Ihrer eigenen GPU oder Ihrem Server mit Tools wie Ollama, vLLM oder llama.cpp ausführen können — ohne Kosten pro Token.

Verwandte Modelle

Gemini 3.1 Pro PreviewGoogleGemini 3.1 Pro Preview Custom ToolsGoogleNano Banana Pro (Gemini 3 Pro Image Preview)GoogleGemini 2.5 ProGoogleGemini 2.5 Pro Preview 05-06GoogleGemini 3.5 FlashGoogle