Google

GGemini 3.1 Flash LiteAPI

Gemini 3.1 Flash Lite (Google): Live-API-Preise, Kontextfenster und die besten Open-Source-Alternativen, täglich verfolgt von OpenSourceAI.tech.

Kontextfenster
1M
Tokens
Eingabepreis
$0.25
pro M Tokens
Ausgabepreis
$1.5
pro M Tokens
Anbieter
Google

Preise aktualisieren sich automatisch — stündlich überprüft gegen die Preisliste der Anbieter.

Siehe Open-Source-Alternativen → Vergleiche alle Modellpreise

Benchmarks & Leistung

Unabhängige Benchmark-Ergebnisse für Gemini 3.1 Flash Lite, gemessen von Artificial Analysis. Höher ist besser.

Intelligence index25
Coding index34.7
GPQA82.2%
Humanity's Last Exam16.2%
Long Context Reasoning65.3%
SciCode41.9%
IFBench77.2%
τ²-Bench31.3%
τ-Bench Banking8.7%
Terminal-Bench31.1%
Terminal-Bench Hard24.2%
⚡ Speed309.5 tokens/sec
⏱ Latency5.7s to first token
💰 Blended price$0.563 / 1M tokens
📈 Value44.4 intelligence points per $
Benchmark-Daten von Artificial Analysis

Über dieses Modell

Gemini 3.1 Flash Lite ist ein kommerzielles KI-Modell von Google. Die folgenden Spezifikationen werden automatisch verfolgt: Die Preise werden stündlich von öffentlichen Listenpreisen aktualisiert, sodass die Zahlen auf dieser Seite die aktuellen Kosten für die Nutzung des Modells über seine API widerspiegeln.

Häufig gestellte Fragen

Was ist Gemini 3.1 Flash Lite?

Gemini 3.1 Flash Lite ist ein KI-Sprachmodell von Google. Es ist ein proprietäres Modell, das über eine API verfügbar ist. Es erzielt 25 im Artificial Analysis Intelligenzindex.

Ist Gemini 3.1 Flash Lite kostenlos?

Gemini 3.1 Flash Lite ist nicht kostenlos: es kostet $0.25 pro Million Eingabetokens und $1.5 pro Million Ausgabetokens. Open-Weight-Alternativen können ohne Kosten pro Token selbst gehostet werden.

Was kann Gemini 3.1 Flash Lite gut?

Unabhängige Benchmarks von Artificial Analysis geben ihm GPQA 82.2%, Humanity's Last Exam 16.2%, Long Context Reasoning 65.3%, SciCode 41.9%, IFBench 77.2%, τ²-Bench 31.3%, τ-Bench Banking 8.7%, Terminal-Bench 31.1%, Terminal-Bench Hard 24.2%. Es wird besonders verwendet für Code-Generierung.

Wie schnell ist Gemini 3.1 Flash Lite?

Es generiert etwa 309.5 Tokens pro Sekunde, mit einer Median 5.7s Verzögerung vor dem ersten Token. Unabhängig von Artificial Analysis gemessen.

Open-Source-Alternativen

Je nach Arbeitslast kann ein Open-Weight-Modell, das Sie selbst hosten können, die Kosten drastisch senken oder die Preisgestaltung pro Token vollständig entfernen. Unsere Vergleichsseiten stellen dieses Modell neben die stärksten Open-Source-Kandidaten.

Gemini 3.1 Pro PreviewGoogleGemini 2.5 ProGoogleGemini 3.5 FlashGoogleGemini 3.6 FlashGoogleGemini 3 Flash PreviewGoogleGemini 2.5 FlashGoogle