Llama 4 Maverick (Meta): Live-API-Preise, Kontextfenster und die besten Open-Source-Alternativen, täglich verfolgt von olud.ai.
Preise werden automatisch aktualisiert — täglich geprüft anhand der Listenpreise der Anbieter.
Unabhängige Benchmark-Ergebnisse für Llama 4 Maverick, gemessen von Artificial Analysis. Höher ist besser.
Llama 4 Maverick ist ein Open-Weight-KI-Modell von Meta. Sie können es kostenlos herunterladen und selbst hosten; die unten aufgeführten Preise sind die Listenpreise für gehostete APIs, die täglich aktualisiert werden, für den Fall, dass Sie Komfort dem Selbsthosten vorziehen.
Llama 4 Maverick ist ein KI-Sprachmodell von Meta. Es ist open-weight: Sie können es herunterladen und auf Ihrer eigenen Hardware kostenlos ausführen. Es erzielt 14.5 im Artificial Analysis Intelligenzindex.
Die Gewichte sind kostenlos und offen — Sie können Llama 4 Maverick selbst hosten und zahlen nichts pro Token. Wenn Sie eine gehostete API bevorzugen, liegen die Listenpreise bei $0.2 pro Million Eingabetokens und $0.8 pro Million Ausgabetokens.
Unabhängige Benchmarks von Artificial Analysis geben ihm GPQA 67.1%, MMLU-Pro 80.9%, Humanity's Last Exam 4.9%, Long Context Reasoning 50%, LiveCodeBench 39.7%, SciCode 33.1%, MATH-500 88.9%, AIME 39%, AIME 2025 19.3%, IFBench 43%, τ²-Bench 17.8%, τ-Bench Banking 3.7%, Terminal-Bench 7.9%, Terminal-Bench Hard 6.8%. Es wird besonders verwendet für Code-Generierung.
Es generiert etwa 101.8 Tokens pro Sekunde, mit einer Median 0.58s Verzögerung vor dem ersten Token. Unabhängig von Artificial Analysis gemessen.
Ja. Llama 4 Maverick hat open weights, sodass Sie es herunterladen und auf Ihrer eigenen GPU oder Ihrem Server mit Tools wie Ollama, vLLM oder llama.cpp ausführen können — ohne Kosten pro Token.