Meta · tutti i modelli ›

MLlama 3.3 70B InstructOPEN

Il modello linguistico multilingue di grandi dimensioni (LLM) Meta Llama 3.3 è un modello generativo pre-addestrato e ottimizzato per le istruzioni in 70B (testo in/testo out).

131KFinestra di contesto · token
$0.71Prezzo di input · per M token
$0.71Prezzo di output · per M token
MetaFornitore

I prezzi vengono aggiornati automaticamente — verificati quotidianamente rispetto ai listini prezzi dei fornitori.

Vedi confronti dei modelli → Confronta tutti i prezzi dei modelli

Benchmark e prestazioni

Punteggi di benchmark indipendenti per Llama 3.3 70B Instruct, misurati da Artificial Analysis. Maggiore è meglio.

2.2×
Maggiore intelligenza per dollaro rispetto a Claude Opus 5 (Fast).
A parità di budget, Llama 3.3 70B Instruct offre 2.2 volte più capacità. Open weights significa anche che può self-hostarlo e non pagare nulla per token.
Intelligence index9.3
Coding index11.9
Math index7.7
GPQA49.8%
MMLU-Pro71.3%
Humanity's Last Exam3.6%
Long Context Reasoning15.7%
LiveCodeBench28.8%
SciCode26%
MATH-50077.3%
AIME30%
AIME 20257.7%
IFBench47.1%
τ²-Bench26.6%
Terminal-Bench4.9%
Terminal-Bench Hard3%
⚡ Speed86.2 tokens/sec
⏱ Latency0.62s to first token
💰 Blended price$0.671 / 1M tokens
📈 Value13.9 intelligence points per $
vs. modelli misurati quitop 85%
Punteggi superiori a 15% dei 273 modelli misurati da Artificial Analysis e tracciati qui.
I modelli a questo livello costano $0.2 per 1M token (mediana di 26) — questo costa $0.71.
Più economico e migliore su questo indice: GLM 5.3 Flash · Gemini 3.7 Flash (batch) · GPT-5.6 Luna e 81 in più
Dati di benchmark di Artificial Analysis

Informazioni su questo modello

Llama 3.3 70B Instruct è un modello AI open-weight di Meta. Puoi scaricarlo e self-hostarlo gratuitamente; i prezzi sottostanti sono i prezzi di listino delle API hosted, monitorati quotidianamente, per quando preferisci la comodità al self-hosting.

Domande frequenti

Cos'è Llama 3.3 70B Instruct?

Llama 3.3 70B Instruct è un modello di linguaggio AI di Meta. È open-weight: può scaricarlo ed eseguirlo sul proprio hardware, gratuitamente. Ottiene 9.3 sull'indice di intelligenza Artificial Analysis.

Llama 3.3 70B Instruct è gratuito?

I pesi sono gratuiti e aperti — può self-hostare Llama 3.3 70B Instruct e non pagare nulla per token. Se preferisce un'API ospitata, i prezzi di listino sono $0,71 per milione di token di input e $0,71 per milione di token di output.

A cosa serve Llama 3.3 70B Instruct?

I benchmark indipendenti di Artificial Analysis gli danno GPQA 49.8%, MMLU-Pro 71.3%, Humanity's Last Exam 3.6%, Long Context Reasoning 15.7%, LiveCodeBench 28.8%, SciCode 26%, MATH-500 77.3%, AIME 30%, AIME 2025 7.7%, IFBench 47.1%, τ²-Bench 26.6%, Terminal-Bench 4.9%, Terminal-Bench Hard 3%. È particolarmente utilizzato per generazione di codice.

Quanto è veloce Llama 3.3 70B Instruct?

Genera circa 86.2 token al secondo, con una mediana 0.62s di ritardo prima del primo token. Misurato indipendentemente da Artificial Analysis.

Posso ospitare autonomamente Llama 3.3 70B Instruct?

Sì. Llama 3.3 70B Instruct ha open weights, quindi può scaricarlo ed eseguirlo sulla sua GPU o server con strumenti come Ollama, vLLM o llama.cpp — senza costi per token.

Modelli correlati

Muse Spark 1.2MetaMuse Spark 1.1MetaMuse Spark 1.2 ContributorMetaLlama 3.1 8B InstructMetaMuse Glimmer 30BMetaLlama 4 MaverickMeta