Llama 3.3 70B Instruct (Meta): prezzi API live, finestra di contesto e le migliori alternative open-source, monitorate quotidianamente da OpenSourceAI.tech.
I prezzi si aggiornano automaticamente — controllati ogni ora rispetto ai prezzi della lista dei fornitori.
Punteggi di benchmark indipendenti per Llama 3.3 70B Instruct, misurati da Artificial Analysis. Maggiore è meglio.
Llama 3.3 70B Instruct è un modello AI a peso aperto di Meta. Puoi scaricarlo e ospitarlo autonomamente gratuitamente; i prezzi qui sotto sono i prezzi di lista delle API ospitate, monitorati ogni ora, per quando preferisci la comodità all'auto-ospitazione.
Llama 3.3 70B Instruct è un modello di linguaggio AI di Meta. È a peso aperto: puoi scaricarlo ed eseguirlo sul tuo hardware, gratuitamente. Ottiene 9.4 sull'indice di intelligenza Artificial Analysis.
I pesi sono gratuiti e aperti — puoi auto-ospitare Llama 3.3 70B Instruct e non pagare nulla per token. Se preferisci un'API ospitata, i prezzi di listino sono $0.13 per milione di token in input e $0.4 per milione di token in output.
I benchmark indipendenti di Artificial Analysis gli danno GPQA 49.8%, MMLU-Pro 71.3%, Humanity's Last Exam 4%, Long Context Reasoning 15%, LiveCodeBench 28.8%, SciCode 26%, MATH-500 77.3%, AIME 30%, AIME 2025 7.7%, IFBench 47.1%, τ²-Bench 26.6%, τ-Bench Banking 1%, Terminal-Bench 4.9%, Terminal-Bench Hard 3%. È particolarmente utilizzato per generazione di codice.
Genera circa 79.3 token al secondo, con una mediana 0.64s di ritardo prima del primo token. Misurato indipendentemente da Artificial Analysis.
Sì. Llama 3.3 70B Instruct ha pesi aperti, quindi puoi scaricarlo ed eseguirlo sulla tua GPU o server con strumenti come Ollama, vLLM o llama.cpp — senza costi per token.
A seconda del tuo carico di lavoro, un modello a peso aperto che puoi ospitare autonomamente potrebbe ridurre drasticamente i costi o rimuovere completamente la tariffazione per token. Le nostre pagine di confronto mettono questo modello a confronto con i più forti contendenti open-source.