Meta · alle Modelle ›

MLlama 4 ScoutOPEN

Llama 4 Scout 17B Instruct (16E) ist ein Mischmodell (MoE) von Meta, das 17 Milliarden Parameter aus insgesamt 109B aktiviert.

1.3MKontextfenster · Tokens
$0.11Eingabepreis · pro M Tokens
$0.34Ausgabepreis · pro M Tokens
MetaAnbieter

Preise werden automatisch aktualisiert — täglich geprüft anhand der Listenpreise der Anbieter.

Siehe Modellvergleiche → Vergleiche alle Modellpreise

Benchmarks & Leistung

Unabhängige Benchmark-Ergebnisse für Llama 4 Scout, gemessen von Artificial Analysis. Höher ist besser.

5.4×
Mehr Intelligenz pro Dollar als Claude Opus 5 (Fast).
Für das gleiche Budget bietet Llama 4 Scout die 5,4-fache Leistungsfähigkeit. Open weights bedeuten auch, dass Sie es selbst hosten und nichts pro Token bezahlen können.
Intelligence index10.3
Coding index8.2
Math index14
GPQA58.7%
MMLU-Pro75.2%
Humanity's Last Exam3.8%
Long Context Reasoning30.3%
LiveCodeBench29.9%
SciCode17%
MATH-50084.4%
AIME28.3%
AIME 202514%
IFBench39.5%
τ²-Bench15.5%
τ-Bench Banking3.3%
Terminal-Bench3.7%
Terminal-Bench Hard1.5%
⚡ Speed137.4 tokens/sec
⏱ Latency0.56s to first token
💰 Blended price$0.3 / 1M tokens
📈 Value34.3 intelligence points per $
vs. Modelle, die hier gemessen werdenoberste 82%
Scores höher als 18% der 273 Modelle, die von Artificial Analysis gemessen und hier verfolgt werden.
Modelle auf diesem Niveau kosten $0.23 pro 1M Tokens (Median von 24) — dieses kostet $0.17.
Günstiger und besser in diesem Index: GLM 5.3 Flash · DeepSeek V4 Flash 0731 · DeepSeek V4 Flash 0423 und 20 mehr
Benchmark-Daten von Artificial Analysis

Über dieses Modell

Llama 4 Scout ist ein Open-Weight-KI-Modell von Meta. Sie können es kostenlos herunterladen und selbst hosten; die unten angegebenen Preise sind die täglich aktualisierten Listenpreise der gehosteten APIs, für den Fall, dass Sie Bequemlichkeit dem Selbsthosten vorziehen.

Häufig gestellte Fragen

Was ist Llama 4 Scout?

Llama 4 Scout ist ein KI-Sprachmodell von Meta. Es ist open-weight: Sie können es herunterladen und auf Ihrer eigenen Hardware kostenlos ausführen. Es erzielt 10.3 im Artificial Analysis Intelligenzindex.

Ist Llama 4 Scout kostenlos?

Die Gewichte sind frei und offen — Sie können Llama 4 Scout selbst hosten und zahlen nichts pro Token. Wenn Sie eine gehostete API bevorzugen, liegen die Listenpreise bei 0,11 $ pro Million Eingabe-Tokens und 0,34 $ pro Million Ausgabe-Tokens.

Worin ist Llama 4 Scout gut?

Unabhängige Benchmarks von Artificial Analysis geben ihm GPQA 58.7%, MMLU-Pro 75.2%, Humanity's Last Exam 3.8%, Long Context Reasoning 30.3%, LiveCodeBench 29.9%, SciCode 17%, MATH-500 84.4%, AIME 28.3%, AIME 2025 14%, IFBench 39.5%, τ²-Bench 15.5%, τ-Bench Banking 3.3%, Terminal-Bench 3.7%, Terminal-Bench Hard 1.5%. Es wird besonders verwendet für Code-Generierung.

Wie schnell ist Llama 4 Scout?

Es generiert etwa 137.4 Tokens pro Sekunde, mit einer Median 0.56s Verzögerung vor dem ersten Token. Unabhängig von Artificial Analysis gemessen.

Kann ich Llama 4 Scout selbst hosten?

Ja. Llama 4 Scout hat open weights, sodass Sie es herunterladen und auf Ihrer eigenen GPU oder Ihrem Server mit Tools wie Ollama, vLLM oder llama.cpp ausführen können — ohne Kosten pro Token.

Verwandte Modelle

Muse Spark 1.2MetaMuse Spark 1.1MetaMuse Spark 1.2 ContributorMetaLlama 3.1 8B InstructMetaLlama 3.3 70B InstructMetaMuse Glimmer 30BMeta