Meta

MLlama 3.3 70B InstructOPEN

Llama 3.3 70B Instruct (Meta): prezzi API live, finestra di contesto e le migliori alternative open-source, monitorate quotidianamente da OpenSourceAI.tech.

Finestra di contesto
131K
token
Prezzo di input
$0.13
per M token
Prezzo di output
$0.4
per M token
Fornitore
Meta

I prezzi si aggiornano automaticamente — controllati ogni ora rispetto ai prezzi della lista dei fornitori.

Vedi confronti dei modelli → Confronta tutti i prezzi dei modelli

Benchmark e prestazioni

Punteggi di benchmark indipendenti per Llama 3.3 70B Instruct, misurati da Artificial Analysis. Maggiore è meglio.

2.4×
Maggiore intelligenza per dollaro rispetto a Claude Opus 5.
Con lo stesso budget, Llama 3.3 70B Instruct offre 2.4 volte più capacità. I pesi aperti significano anche che puoi ospitarlo autonomamente e non pagare nulla per token.
Intelligence index9.4
Coding index11.9
Math index7.7
GPQA49.8%
MMLU-Pro71.3%
Humanity's Last Exam4%
Long Context Reasoning15%
LiveCodeBench28.8%
SciCode26%
MATH-50077.3%
AIME30%
AIME 20257.7%
IFBench47.1%
τ²-Bench26.6%
τ-Bench Banking1%
Terminal-Bench4.9%
Terminal-Bench Hard3%
⚡ Speed79.3 tokens/sec
⏱ Latency0.64s to first token
💰 Blended price$0.63 / 1M tokens
📈 Value14.9 intelligence points per $
Dati di benchmark di Artificial Analysis

Informazioni su questo modello

Llama 3.3 70B Instruct è un modello AI a peso aperto di Meta. Puoi scaricarlo e ospitarlo autonomamente gratuitamente; i prezzi qui sotto sono i prezzi di lista delle API ospitate, monitorati ogni ora, per quando preferisci la comodità all'auto-ospitazione.

Domande frequenti

Cos'è Llama 3.3 70B Instruct?

Llama 3.3 70B Instruct è un modello di linguaggio AI di Meta. È a peso aperto: puoi scaricarlo ed eseguirlo sul tuo hardware, gratuitamente. Ottiene 9.4 sull'indice di intelligenza Artificial Analysis.

Llama 3.3 70B Instruct è gratuito?

I pesi sono gratuiti e aperti — puoi auto-ospitare Llama 3.3 70B Instruct e non pagare nulla per token. Se preferisci un'API ospitata, i prezzi di listino sono $0.13 per milione di token in input e $0.4 per milione di token in output.

A cosa serve Llama 3.3 70B Instruct?

I benchmark indipendenti di Artificial Analysis gli danno GPQA 49.8%, MMLU-Pro 71.3%, Humanity's Last Exam 4%, Long Context Reasoning 15%, LiveCodeBench 28.8%, SciCode 26%, MATH-500 77.3%, AIME 30%, AIME 2025 7.7%, IFBench 47.1%, τ²-Bench 26.6%, τ-Bench Banking 1%, Terminal-Bench 4.9%, Terminal-Bench Hard 3%. È particolarmente utilizzato per generazione di codice.

Quanto è veloce Llama 3.3 70B Instruct?

Genera circa 79.3 token al secondo, con una mediana 0.64s di ritardo prima del primo token. Misurato indipendentemente da Artificial Analysis.

Posso ospitare autonomamente Llama 3.3 70B Instruct?

Sì. Llama 3.3 70B Instruct ha pesi aperti, quindi puoi scaricarlo ed eseguirlo sulla tua GPU o server con strumenti come Ollama, vLLM o llama.cpp — senza costi per token.

Alternative open-source

A seconda del tuo carico di lavoro, un modello a peso aperto che puoi ospitare autonomamente potrebbe ridurre drasticamente i costi o rimuovere completamente la tariffazione per token. Le nostre pagine di confronto mettono questo modello a confronto con i più forti contendenti open-source.

Llama 3.1 8B InstructMetaLlama 4 MaverickMetaLlama 4 ScoutMetaLlama 3.1 70B InstructMetaLlama Guard 4 12BMetaLlama 3.2 3B InstructMeta