Il modello linguistico multilingue di grandi dimensioni (LLM) Meta Llama 3.3 è un modello generativo pre-addestrato e ottimizzato per le istruzioni in 70B (testo in/testo out).
I prezzi vengono aggiornati automaticamente — verificati quotidianamente rispetto ai listini prezzi dei fornitori.
Punteggi di benchmark indipendenti per Llama 3.3 70B Instruct, misurati da Artificial Analysis. Maggiore è meglio.
Llama 3.3 70B Instruct è un modello AI open-weight di Meta. Puoi scaricarlo e self-hostarlo gratuitamente; i prezzi sottostanti sono i prezzi di listino delle API hosted, monitorati quotidianamente, per quando preferisci la comodità al self-hosting.
Llama 3.3 70B Instruct è un modello di linguaggio AI di Meta. È open-weight: può scaricarlo ed eseguirlo sul proprio hardware, gratuitamente. Ottiene 9.3 sull'indice di intelligenza Artificial Analysis.
I pesi sono gratuiti e aperti — può self-hostare Llama 3.3 70B Instruct e non pagare nulla per token. Se preferisce un'API ospitata, i prezzi di listino sono $0,71 per milione di token di input e $0,71 per milione di token di output.
I benchmark indipendenti di Artificial Analysis gli danno GPQA 49.8%, MMLU-Pro 71.3%, Humanity's Last Exam 3.6%, Long Context Reasoning 15.7%, LiveCodeBench 28.8%, SciCode 26%, MATH-500 77.3%, AIME 30%, AIME 2025 7.7%, IFBench 47.1%, τ²-Bench 26.6%, Terminal-Bench 4.9%, Terminal-Bench Hard 3%. È particolarmente utilizzato per generazione di codice.
Genera circa 86.2 token al secondo, con una mediana 0.62s di ritardo prima del primo token. Misurato indipendentemente da Artificial Analysis.
Sì. Llama 3.3 70B Instruct ha open weights, quindi può scaricarlo ed eseguirlo sulla sua GPU o server con strumenti come Ollama, vLLM o llama.cpp — senza costi per token.