Le modèle de langage multilingue (LLM) Meta Llama 3.3 est un modèle génératif pré-entraîné et ajusté par instruction de 70 milliards (texte en/texte out).
Les prix se mettent à jour automatiquement — vérifiés quotidiennement par rapport aux prix catalogue des fournisseurs.
Scores de référence indépendants pour Llama 3.3 70B Instruct, mesurés par Artificial Analysis. Plus c'est élevé, mieux c'est.
Llama 3.3 70B Instruct est un modèle d'IA open-weight de Meta. Vous pouvez le télécharger et le déployer en self-hosted gratuitement ; les prix ci-dessous sont les prix de liste de l'API hébergée, suivis quotidiennement, pour quand vous préférez la commodité au self-hosting.
Llama 3.3 70B Instruct est un modèle de langage IA de Meta. Il est open-weight : vous pouvez le télécharger et l'exécuter sur votre propre matériel, gratuitement. Il obtient un score de 9.3 sur l'indice d'intelligence d'Artificial Analysis.
Les poids sont gratuits et ouverts — vous pouvez auto-héberger Llama 3.3 70B Instruct et ne rien payer par jeton. Si vous préférez une API hébergée, les prix catalogue sont de $0.71 par million de jetons d'entrée et $0.71 par million de jetons de sortie.
Des benchmarks indépendants d'Artificial Analysis lui donnent GPQA 49.8%, MMLU-Pro 71.3%, Humanity's Last Exam 3.6%, Long Context Reasoning 15.7%, LiveCodeBench 28.8%, SciCode 26%, MATH-500 77.3%, AIME 30%, AIME 2025 7.7%, IFBench 47.1%, τ²-Bench 26.6%, Terminal-Bench 4.9%, Terminal-Bench Hard 3%. Il est particulièrement utilisé pour génération de code.
Il génère environ 86.2 tokens par seconde, avec un délai médian 0.62s avant le premier token. Mesuré indépendamment par Artificial Analysis.
Oui. Llama 3.3 70B Instruct a des open weights, donc vous pouvez le télécharger et l'exécuter sur votre propre GPU ou serveur avec des outils comme Ollama, vLLM ou llama.cpp — sans coût par token.