Gemma 3 4B (Google): Live-API-Preise, Kontextfenster und die besten Open-Source-Alternativen, täglich verfolgt von OpenSourceAI.tech.
Preise aktualisieren sich automatisch — stündlich überprüft gegen die Preisliste der Anbieter.
Unabhängige Benchmark-Ergebnisse für Gemma 3 4B, gemessen von Artificial Analysis. Höher ist besser.
Gemma 3 4B ist ein Open-Weight-AI-Modell von Google. Sie können es kostenlos herunterladen und selbst hosten; die unten aufgeführten Preise sind Listenpreise für gehostete APIs, die stündlich verfolgt werden, wenn Sie Bequemlichkeit gegenüber Selbsthosting bevorzugen.
Gemma 3 4B ist ein KI-Sprachmodell von Google. Es hat offene Gewichte: Sie können es herunterladen und kostenlos auf Ihrer eigenen Hardware ausführen. Es erzielt 1.1 im Artificial Analysis Intelligenzindex.
Die Gewichte sind kostenlos und offen — Sie können Gemma 3 4B selbst hosten und zahlen nichts pro Token. Wenn Sie eine gehostete API bevorzugen, liegen die Listenpreise bei 0,05 $ pro Million Eingabetokens und 0,1 $ pro Million Ausgabetokens.
Unabhängige Benchmarks von Artificial Analysis geben ihm GPQA 29.1%, MMLU-Pro 41.7%, Humanity's Last Exam 5.2%, Long Context Reasoning 5.7%, LiveCodeBench 11.2%, SciCode 7.3%, MATH-500 76.6%, AIME 6.3%, AIME 2025 12.7%, IFBench 28.3%, τ²-Bench 5%, τ-Bench Banking 0.4%, Terminal-Bench 0.4%, Terminal-Bench Hard 0.8%. Es wird besonders verwendet für Code-Generierung.
Ja. Gemma 3 4B hat offene Gewichte, sodass Sie es herunterladen und auf Ihrer eigenen GPU oder Ihrem Server mit Tools wie Ollama, vLLM oder llama.cpp ausführen können — ohne Kosten pro Token.
Je nach Arbeitslast kann ein Open-Weight-Modell, das Sie selbst hosten können, die Kosten drastisch senken oder die Preisgestaltung pro Token vollständig entfernen. Unsere Vergleichsseiten stellen dieses Modell neben die stärksten Open-Source-Kandidaten.