Google

GGemini 3.5 Flash LiteAPI

Gemini 3.5 Flash Lite (Google): Live-API-Preise, Kontextfenster und die besten Open-Source-Alternativen, täglich verfolgt von OpenSourceAI.tech.

Kontextfenster
1M
Tokens
Eingabepreis
$0.3
pro M Tokens
Ausgabepreis
$2.5
pro M Tokens
Anbieter
Google

Preise aktualisieren sich automatisch — stündlich überprüft gegen die Preisliste der Anbieter.

Siehe Open-Source-Alternativen → Vergleiche alle Modellpreise

Benchmarks & Leistung

Unabhängige Benchmark-Ergebnisse für Gemini 3.5 Flash Lite, gemessen von Artificial Analysis. Höher ist besser.

Intelligence index36.5
Coding index49.3
GPQA83.8%
Humanity's Last Exam17.5%
Long Context Reasoning62%
SciCode40.9%
τ-Bench Banking16.5%
Terminal-Bench53.6%
⚡ Speed365.6 tokens/sec
⏱ Latency7.29s to first token
💰 Blended price$0.85 / 1M tokens
📈 Value42.9 intelligence points per $
Benchmark-Daten von Artificial Analysis

Über dieses Modell

Gemini 3.5 Flash Lite ist ein kommerzielles KI-Modell von Google. Die folgenden Spezifikationen werden automatisch verfolgt: Die Preise werden stündlich aus öffentlichen Listenpreisen aktualisiert, sodass die Zahlen auf dieser Seite die aktuellen Kosten für die Nutzung des Modells über seine API widerspiegeln.

Häufig gestellte Fragen

Was ist Gemini 3.5 Flash Lite?

Gemini 3.5 Flash Lite ist ein KI-Sprachmodell von Google. Es ist ein proprietäres Modell, das über eine API verfügbar ist. Es erzielt 36.5 im Artificial Analysis Intelligenzindex.

Ist Gemini 3.5 Flash Lite kostenlos?

Gemini 3.5 Flash Lite ist nicht kostenlos: Es kostet 0,3 $ pro Million Eingabetokens und 2,5 $ pro Million Ausgabetokens. Open-Weight-Alternativen können selbst gehostet werden, ohne Kosten pro Token.

Worin ist Gemini 3.5 Flash Lite gut?

Unabhängige Benchmarks von Artificial Analysis geben ihm GPQA 83.8%, Humanity's Last Exam 17.5%, Long Context Reasoning 62%, SciCode 40.9%, τ-Bench Banking 16.5%, Terminal-Bench 53.6%. Es wird besonders verwendet für Code-Generierung.

Wie schnell ist Gemini 3.5 Flash Lite?

Es generiert etwa 365.6 Tokens pro Sekunde, mit einer Median 7.29s Verzögerung vor dem ersten Token. Unabhängig von Artificial Analysis gemessen.

Open-Source-Alternativen

Je nach Arbeitslast kann ein Open-Weight-Modell, das Sie selbst hosten können, die Kosten drastisch senken oder die Preisgestaltung pro Token vollständig entfernen. Unsere Vergleichsseiten stellen dieses Modell neben die stärksten Open-Source-Kandidaten.

Gemini 3.1 Pro PreviewGoogleGemini 2.5 ProGoogleGemini 3.5 FlashGoogleGemini 3.6 FlashGoogleGemini 3 Flash PreviewGoogleGemini 2.5 FlashGoogle