Das Meta Llama 3.3 mehrsprachige große Sprachmodell (LLM) ist ein vortrainiertes und anweisungsoptimiertes generatives Modell mit 70B (Text rein/Text raus).
Preise werden automatisch aktualisiert — täglich geprüft anhand der Listenpreise der Anbieter.
Unabhängige Benchmark-Ergebnisse für Llama 3.3 70B Instruct, gemessen von Artificial Analysis. Höher ist besser.
Llama 3.3 70B Instruct ist ein Open-Weight-KI-Modell von Meta. Sie können es kostenlos herunterladen und selbst hosten; die unten aufgeführten Preise sind die Listenpreise für gehostete APIs, die täglich aktualisiert werden, für den Fall, dass Sie Komfort dem Selbsthosten vorziehen.
Llama 3.3 70B Instruct ist ein KI-Sprachmodell von Meta. Es ist open-weight: Sie können es herunterladen und auf Ihrer eigenen Hardware kostenlos ausführen. Es erzielt 9.3 im Artificial Analysis Intelligenzindex.
Die Gewichte sind frei und offen — Sie können Llama 3.3 70B Instruct selbst hosten und zahlen nichts pro Token. Wenn Sie eine gehostete API bevorzugen, liegen die Listenpreise bei 0,71 $ pro Million Eingabe-Tokens und 0,71 $ pro Million Ausgabe-Tokens.
Unabhängige Benchmarks von Artificial Analysis geben ihm GPQA 49.8%, MMLU-Pro 71.3%, Humanity's Last Exam 3.6%, Long Context Reasoning 15.7%, LiveCodeBench 28.8%, SciCode 26%, MATH-500 77.3%, AIME 30%, AIME 2025 7.7%, IFBench 47.1%, τ²-Bench 26.6%, Terminal-Bench 4.9%, Terminal-Bench Hard 3%. Es wird besonders verwendet für Code-Generierung.
Es generiert etwa 86.2 Tokens pro Sekunde, mit einer Median 0.62s Verzögerung vor dem ersten Token. Unabhängig von Artificial Analysis gemessen.
Ja. Llama 3.3 70B Instruct hat open weights, sodass Sie es herunterladen und auf Ihrer eigenen GPU oder Ihrem Server mit Tools wie Ollama, vLLM oder llama.cpp ausführen können — ohne Kosten pro Token.