Meta

MLlama 3.3 70B InstructOPEN

Llama 3.3 70B Instruct (Meta): Live-API-Preise, Kontextfenster und die besten Open-Source-Alternativen, täglich verfolgt von OpenSourceAI.tech.

Kontextfenster
131K
Tokens
Eingabepreis
$0.13
pro M Tokens
Ausgabepreis
$0.4
pro M Tokens
Anbieter
Meta

Preise aktualisieren sich automatisch — stündlich überprüft gegen die Preisliste der Anbieter.

Siehe Modellvergleiche → Vergleiche alle Modellpreise

Benchmarks & Leistung

Unabhängige Benchmark-Ergebnisse für Llama 3.3 70B Instruct, gemessen von Artificial Analysis. Höher ist besser.

2.4×
Mehr Intelligenz pro Dollar als Claude Opus 5.
Für dasselbe Budget bietet Llama 3.3 70B Instruct 2,4-mal mehr Leistung. Offene Gewichte bedeuten auch, dass Sie es selbst hosten können und nichts pro Token zahlen müssen.
Intelligence index9.4
Coding index11.9
Math index7.7
GPQA49.8%
MMLU-Pro71.3%
Humanity's Last Exam4%
Long Context Reasoning15%
LiveCodeBench28.8%
SciCode26%
MATH-50077.3%
AIME30%
AIME 20257.7%
IFBench47.1%
τ²-Bench26.6%
τ-Bench Banking1%
Terminal-Bench4.9%
Terminal-Bench Hard3%
⚡ Speed79.3 tokens/sec
⏱ Latency0.64s to first token
💰 Blended price$0.63 / 1M tokens
📈 Value14.9 intelligence points per $
Benchmark-Daten von Artificial Analysis

Über dieses Modell

Llama 3.3 70B Instruct ist ein Open-Weight-AI-Modell von Meta. Sie können es kostenlos herunterladen und selbst hosten; die unten aufgeführten Preise sind Listenpreise für gehostete APIs, die stündlich verfolgt werden, wenn Sie Bequemlichkeit gegenüber Selbsthosting bevorzugen.

Häufig gestellte Fragen

Was ist Llama 3.3 70B Instruct?

Llama 3.3 70B Instruct ist ein KI-Sprachmodell von Meta. Es hat offene Gewichte: Sie können es herunterladen und kostenlos auf Ihrer eigenen Hardware ausführen. Es erzielt 9.4 im Artificial Analysis Intelligenzindex.

Ist Llama 3.3 70B Instruct kostenlos?

Die Gewichte sind kostenlos und offen — Sie können Llama 3.3 70B Instruct selbst hosten und zahlen nichts pro Token. Wenn Sie eine gehostete API bevorzugen, liegen die Listenpreise bei 0,13 $ pro Million Eingabetokens und 0,4 $ pro Million Ausgabetokens.

Worin ist Llama 3.3 70B Instruct gut?

Unabhängige Benchmarks von Artificial Analysis geben ihm GPQA 49.8%, MMLU-Pro 71.3%, Humanity's Last Exam 4%, Long Context Reasoning 15%, LiveCodeBench 28.8%, SciCode 26%, MATH-500 77.3%, AIME 30%, AIME 2025 7.7%, IFBench 47.1%, τ²-Bench 26.6%, τ-Bench Banking 1%, Terminal-Bench 4.9%, Terminal-Bench Hard 3%. Es wird besonders verwendet für Code-Generierung.

Wie schnell ist Llama 3.3 70B Instruct?

Es generiert etwa 79.3 Tokens pro Sekunde, mit einer Median 0.64s Verzögerung vor dem ersten Token. Unabhängig von Artificial Analysis gemessen.

Kann ich Llama 3.3 70B Instruct selbst hosten?

Ja. Llama 3.3 70B Instruct hat offene Gewichte, sodass Sie es herunterladen und auf Ihrer eigenen GPU oder Ihrem Server mit Tools wie Ollama, vLLM oder llama.cpp ausführen können — ohne Kosten pro Token.

Open-Source-Alternativen

Je nach Arbeitslast kann ein Open-Weight-Modell, das Sie selbst hosten können, die Kosten drastisch senken oder die Preisgestaltung pro Token vollständig entfernen. Unsere Vergleichsseiten stellen dieses Modell neben die stärksten Open-Source-Kandidaten.

Llama 3.1 8B InstructMetaLlama 4 MaverickMetaLlama 4 ScoutMetaLlama 3.1 70B InstructMetaLlama Guard 4 12BMetaLlama 3.2 3B InstructMeta