Llama 4 Scout (Meta): Live-API-Preise, Kontextfenster und die besten Open-Source-Alternativen, täglich verfolgt von olud.ai.
Preise aktualisieren sich automatisch — stündlich überprüft gegen die Preisliste der Anbieter.
Unabhängige Benchmark-Ergebnisse für Llama 4 Scout, gemessen von Artificial Analysis. Höher ist besser.
Llama 4 Scout ist ein Open-Weight-AI-Modell von Meta. Sie können es kostenlos herunterladen und selbst hosten; die unten aufgeführten Preise sind Listenpreise für gehostete APIs, die stündlich verfolgt werden, wenn Sie Bequemlichkeit gegenüber Selbsthosting bevorzugen.
Llama 4 Scout ist ein KI-Sprachmodell von Meta. Es hat offene Gewichte: Sie können es herunterladen und kostenlos auf Ihrer eigenen Hardware ausführen. Es erzielt 10 im Artificial Analysis Intelligenzindex.
Die Gewichte sind kostenlos und offen — Sie können Llama 4 Scout selbst hosten und zahlen nichts pro Token. Wenn Sie eine gehostete API bevorzugen, liegen die Listenpreise bei 0,1 $ pro Million Eingabetokens und 0,3 $ pro Million Ausgabetokens.
Unabhängige Benchmarks von Artificial Analysis geben ihm GPQA 58.7%, MMLU-Pro 75.2%, Humanity's Last Exam 4.3%, Long Context Reasoning 25.8%, LiveCodeBench 29.9%, SciCode 17%, MATH-500 84.4%, AIME 28.3%, AIME 2025 14%, IFBench 39.5%, τ²-Bench 15.5%, τ-Bench Banking 3.3%, Terminal-Bench 3.7%, Terminal-Bench Hard 1.5%. Es wird besonders verwendet für Code-Generierung.
Es generiert etwa 83.3 Tokens pro Sekunde, mit einer Median 0.61s Verzögerung vor dem ersten Token. Unabhängig von Artificial Analysis gemessen.
Ja. Llama 4 Scout hat offene Gewichte, sodass Sie es herunterladen und auf Ihrer eigenen GPU oder Ihrem Server mit Tools wie Ollama, vLLM oder llama.cpp ausführen können — ohne Kosten pro Token.