Meta

MLlama 3.1 8B InstructOPEN

Llama 3.1 8B Instruct (Meta): Live-API-Preise, Kontextfenster und die besten Open-Source-Alternativen, täglich verfolgt von OpenSourceAI.tech.

Kontextfenster
131K
Tokens
Eingabepreis
$0.05
pro M Tokens
Ausgabepreis
$0.08
pro M Tokens
Anbieter
Meta

Preise aktualisieren sich automatisch — stündlich überprüft gegen die Preisliste der Anbieter.

Siehe Modellvergleiche → Vergleiche alle Modellpreise

Benchmarks & Leistung

Unabhängige Benchmark-Ergebnisse für Llama 3.1 8B Instruct, gemessen von Artificial Analysis. Höher ist besser.

16×
Mehr Intelligenz pro Dollar als Claude Opus 5.
Für dasselbe Budget bietet Llama 3.1 8B Instruct 16-mal mehr Leistung. Offene Gewichte bedeuten auch, dass Sie es selbst hosten können und nichts pro Token zahlen müssen.
Intelligence index7.6
Coding index5.4
Math index4.3
GPQA25.9%
MMLU-Pro47.6%
Humanity's Last Exam5.1%
Long Context Reasoning15.7%
LiveCodeBench11.6%
SciCode13.2%
MATH-50051.9%
AIME7.7%
AIME 20254.3%
IFBench28.6%
τ²-Bench16.4%
τ-Bench Banking1.6%
Terminal-Bench1.5%
Terminal-Bench Hard0.8%
⚡ Speed614.7 tokens/sec
⏱ Latency0.22s to first token
💰 Blended price$0.079 / 1M tokens
📈 Value96.2 intelligence points per $
Benchmark-Daten von Artificial Analysis

Über dieses Modell

Llama 3.1 8B Instruct ist ein Open-Weight-AI-Modell von Meta. Sie können es kostenlos herunterladen und selbst hosten; die untenstehenden Preise sind Listenpreise für gehostete APIs, die stündlich verfolgt werden, wenn Sie Bequemlichkeit gegenüber Selbsthosting bevorzugen.

Häufig gestellte Fragen

Was ist Llama 3.1 8B Instruct?

Llama 3.1 8B Instruct ist ein KI-Sprachmodell von Meta. Es hat offene Gewichte: Sie können es herunterladen und kostenlos auf Ihrer eigenen Hardware ausführen. Es erzielt 7.6 im Artificial Analysis Intelligenzindex.

Ist Llama 3.1 8B Instruct kostenlos?

Die Gewichte sind kostenlos und offen — Sie können Llama 3.1 8B Instruct selbst hosten und zahlen nichts pro Token. Wenn Sie eine gehostete API bevorzugen, liegen die Listenpreise bei 0,05 $ pro Million Eingabetokens und 0,08 $ pro Million Ausgabetokens.

Worin ist Llama 3.1 8B Instruct gut?

Unabhängige Benchmarks von Artificial Analysis geben ihm GPQA 25.9%, MMLU-Pro 47.6%, Humanity's Last Exam 5.1%, Long Context Reasoning 15.7%, LiveCodeBench 11.6%, SciCode 13.2%, MATH-500 51.9%, AIME 7.7%, AIME 2025 4.3%, IFBench 28.6%, τ²-Bench 16.4%, τ-Bench Banking 1.6%, Terminal-Bench 1.5%, Terminal-Bench Hard 0.8%. Es wird besonders verwendet für Code-Generierung.

Wie schnell ist Llama 3.1 8B Instruct?

Es generiert etwa 614.7 Tokens pro Sekunde, mit einer Median 0.22s Verzögerung vor dem ersten Token. Unabhängig von Artificial Analysis gemessen.

Kann ich Llama 3.1 8B Instruct selbst hosten?

Ja. Llama 3.1 8B Instruct hat offene Gewichte, sodass Sie es herunterladen und auf Ihrer eigenen GPU oder Ihrem Server mit Tools wie Ollama, vLLM oder llama.cpp ausführen können — ohne Kosten pro Token.

Open-Source-Alternativen

Je nach Arbeitslast kann ein Open-Weight-Modell, das Sie selbst hosten können, die Kosten drastisch senken oder die Preisgestaltung pro Token vollständig entfernen. Unsere Vergleichsseiten stellen dieses Modell neben die stärksten Open-Source-Kandidaten.

Llama 4 MaverickMetaLlama 3.3 70B InstructMetaLlama 4 ScoutMetaLlama 3.1 70B InstructMetaLlama Guard 4 12BMetaLlama 3.2 3B InstructMeta