Meta

MLlama 3.1 8B InstructOPEN

Llama 3.1 8B Instruct (Meta): prezzi API live, finestra di contesto e le migliori alternative open-source, monitorate quotidianamente da OpenSourceAI.tech.

Finestra di contesto
131K
token
Prezzo di input
$0.05
per M token
Prezzo di output
$0.08
per M token
Fornitore
Meta

I prezzi si aggiornano automaticamente — controllati ogni ora rispetto ai prezzi della lista dei fornitori.

Vedi confronti dei modelli → Confronta tutti i prezzi dei modelli

Benchmark e prestazioni

Punteggi di benchmark indipendenti per Llama 3.1 8B Instruct, misurati da Artificial Analysis. Maggiore è meglio.

16×
Maggiore intelligenza per dollaro rispetto a Claude Opus 5.
Per lo stesso budget, Llama 3.1 8B Instruct offre 16 volte più capacità. I pesi aperti significano anche che puoi ospitarlo autonomamente e non pagare nulla per token.
Intelligence index7.6
Coding index5.4
Math index4.3
GPQA25.9%
MMLU-Pro47.6%
Humanity's Last Exam5.1%
Long Context Reasoning15.7%
LiveCodeBench11.6%
SciCode13.2%
MATH-50051.9%
AIME7.7%
AIME 20254.3%
IFBench28.6%
τ²-Bench16.4%
τ-Bench Banking1.6%
Terminal-Bench1.5%
Terminal-Bench Hard0.8%
⚡ Speed614.7 tokens/sec
⏱ Latency0.22s to first token
💰 Blended price$0.079 / 1M tokens
📈 Value96.2 intelligence points per $
Dati di benchmark di Artificial Analysis

Informazioni su questo modello

Llama 3.1 8B Instruct è un modello AI a peso aperto di Meta. Puoi scaricarlo e ospitarlo autonomamente gratuitamente; i prezzi qui sotto sono i prezzi di lista delle API ospitate, monitorati ogni ora, per quando preferisci la comodità all'auto-ospitamento.

Domande frequenti

Che cos'è Llama 3.1 8B Instruct?

Llama 3.1 8B Instruct è un modello di linguaggio AI di Meta. È a peso aperto: puoi scaricarlo ed eseguirlo sul tuo hardware, gratuitamente. Ottiene 7.6 sull'indice di intelligenza Artificial Analysis.

Llama 3.1 8B Instruct è gratuito?

I pesi sono gratuiti e aperti — puoi auto-ospitare Llama 3.1 8B Instruct e non pagare nulla per token. Se preferisci un'API ospitata, i prezzi di listino sono $0.05 per milione di token in input e $0.08 per milione di token in output.

A cosa serve Llama 3.1 8B Instruct?

I benchmark indipendenti di Artificial Analysis gli danno GPQA 25.9%, MMLU-Pro 47.6%, Humanity's Last Exam 5.1%, Long Context Reasoning 15.7%, LiveCodeBench 11.6%, SciCode 13.2%, MATH-500 51.9%, AIME 7.7%, AIME 2025 4.3%, IFBench 28.6%, τ²-Bench 16.4%, τ-Bench Banking 1.6%, Terminal-Bench 1.5%, Terminal-Bench Hard 0.8%. È particolarmente utilizzato per generazione di codice.

Quanto è veloce Llama 3.1 8B Instruct?

Genera circa 614.7 token al secondo, con una mediana 0.22s di ritardo prima del primo token. Misurato indipendentemente da Artificial Analysis.

Posso ospitare Llama 3.1 8B Instruct da solo?

Sì. Llama 3.1 8B Instruct ha pesi aperti, quindi puoi scaricarlo ed eseguirlo sulla tua GPU o server con strumenti come Ollama, vLLM o llama.cpp — senza costi per token.

Alternative open-source

A seconda del tuo carico di lavoro, un modello a peso aperto che puoi ospitare autonomamente potrebbe ridurre drasticamente i costi o rimuovere completamente la tariffazione per token. Le nostre pagine di confronto mettono questo modello a confronto con i più forti contendenti open-source.

Llama 4 MaverickMetaLlama 3.3 70B InstructMetaLlama 4 ScoutMetaLlama 3.1 70B InstructMetaLlama Guard 4 12BMetaLlama 3.2 3B InstructMeta