Meta · alle Modelle ›

MLlama 3.3 70B InstructOPEN

Das Meta Llama 3.3 mehrsprachige große Sprachmodell (LLM) ist ein vortrainiertes und anweisungsoptimiertes generatives Modell mit 70B (Text rein/Text raus).

131KKontextfenster · Tokens
$0.71Eingabepreis · pro M Tokens
$0.71Ausgabepreis · pro M Tokens
MetaAnbieter

Preise werden automatisch aktualisiert — täglich geprüft anhand der Listenpreise der Anbieter.

Siehe Modellvergleiche → Vergleiche alle Modellpreise

Benchmarks & Leistung

Unabhängige Benchmark-Ergebnisse für Llama 3.3 70B Instruct, gemessen von Artificial Analysis. Höher ist besser.

2.2×
Mehr Intelligenz pro Dollar als Claude Opus 5 (Fast).
Für das gleiche Budget bietet Llama 3.3 70B Instruct die 2,2-fache Leistungsfähigkeit. Open weights bedeuten auch, dass Sie es selbst hosten und nichts pro Token bezahlen können.
Intelligence index9.3
Coding index11.9
Math index7.7
GPQA49.8%
MMLU-Pro71.3%
Humanity's Last Exam3.6%
Long Context Reasoning15.7%
LiveCodeBench28.8%
SciCode26%
MATH-50077.3%
AIME30%
AIME 20257.7%
IFBench47.1%
τ²-Bench26.6%
Terminal-Bench4.9%
Terminal-Bench Hard3%
⚡ Speed86.2 tokens/sec
⏱ Latency0.62s to first token
💰 Blended price$0.671 / 1M tokens
📈 Value13.9 intelligence points per $
vs. Modelle, die hier gemessen werdenoberste 85%
Scores höher als 15% der 273 Modelle, die von Artificial Analysis gemessen und hier verfolgt werden.
Modelle auf diesem Niveau kosten $0.2 pro 1M Tokens (Median von 26) — dieses kostet $0.71.
Günstiger und besser in diesem Index: GLM 5.3 Flash · Gemini 3.7 Flash (batch) · GPT-5.6 Luna und 81 mehr
Benchmark-Daten von Artificial Analysis

Über dieses Modell

Llama 3.3 70B Instruct ist ein Open-Weight-KI-Modell von Meta. Sie können es kostenlos herunterladen und selbst hosten; die unten aufgeführten Preise sind die Listenpreise für gehostete APIs, die täglich aktualisiert werden, für den Fall, dass Sie Komfort dem Selbsthosten vorziehen.

Häufig gestellte Fragen

Was ist Llama 3.3 70B Instruct?

Llama 3.3 70B Instruct ist ein KI-Sprachmodell von Meta. Es ist open-weight: Sie können es herunterladen und auf Ihrer eigenen Hardware kostenlos ausführen. Es erzielt 9.3 im Artificial Analysis Intelligenzindex.

Ist Llama 3.3 70B Instruct kostenlos?

Die Gewichte sind frei und offen — Sie können Llama 3.3 70B Instruct selbst hosten und zahlen nichts pro Token. Wenn Sie eine gehostete API bevorzugen, liegen die Listenpreise bei 0,71 $ pro Million Eingabe-Tokens und 0,71 $ pro Million Ausgabe-Tokens.

Worin ist Llama 3.3 70B Instruct gut?

Unabhängige Benchmarks von Artificial Analysis geben ihm GPQA 49.8%, MMLU-Pro 71.3%, Humanity's Last Exam 3.6%, Long Context Reasoning 15.7%, LiveCodeBench 28.8%, SciCode 26%, MATH-500 77.3%, AIME 30%, AIME 2025 7.7%, IFBench 47.1%, τ²-Bench 26.6%, Terminal-Bench 4.9%, Terminal-Bench Hard 3%. Es wird besonders verwendet für Code-Generierung.

Wie schnell ist Llama 3.3 70B Instruct?

Es generiert etwa 86.2 Tokens pro Sekunde, mit einer Median 0.62s Verzögerung vor dem ersten Token. Unabhängig von Artificial Analysis gemessen.

Kann ich Llama 3.3 70B Instruct selbst hosten?

Ja. Llama 3.3 70B Instruct hat open weights, sodass Sie es herunterladen und auf Ihrer eigenen GPU oder Ihrem Server mit Tools wie Ollama, vLLM oder llama.cpp ausführen können — ohne Kosten pro Token.

Verwandte Modelle

Muse Spark 1.2MetaMuse Spark 1.1MetaMuse Spark 1.2 ContributorMetaLlama 3.1 8B InstructMetaMuse Glimmer 30BMetaLlama 4 MaverickMeta