Llama 3.2 3B est un modèle de langage large multilingue de 3 milliards de paramètres, optimisé pour des tâches avancées de traitement du langage naturel comme la génération de dialogues, le raisonnement et la synthèse.
Les prix se mettent à jour automatiquement — vérifiés quotidiennement par rapport aux prix catalogue des fournisseurs.
Scores de référence indépendants pour Llama 3.2 3B Instruct, mesurés par Artificial Analysis. Plus c'est élevé, mieux c'est.
Llama 3.2 3B Instruct est un modèle d'IA open-weight de Meta. Vous pouvez le télécharger et le self-hoster gratuitement ; les prix ci-dessous sont les prix catalogue des API hébergées, suivis quotidiennement, pour quand vous préférez la commodité au self-hosting.
Llama 3.2 3B Instruct est un modèle de langage IA de Meta. Il est open-weight : vous pouvez le télécharger et l'exécuter sur votre propre matériel, gratuitement. Il obtient un score de 3.9 sur l'indice d'intelligence d'Artificial Analysis.
Les poids sont gratuits et ouverts — vous pouvez auto-héberger Llama 3.2 3B Instruct et ne rien payer par jeton. Si vous préférez une API hébergée, les prix sont de 0,05 $ par million de jetons d'entrée et de 0,33 $ par million de jetons de sortie.
Des benchmarks indépendants d'Artificial Analysis lui donnent GPQA 25.5%, MMLU-Pro 34.7%, Humanity's Last Exam 5.3%, Long Context Reasoning 2.7%, LiveCodeBench 8.3%, SciCode 5.2%, MATH-500 48.9%, AIME 6.7%, AIME 2025 3.3%, IFBench 26.2%, τ²-Bench 21.1%. Il est particulièrement utilisé pour raisonnement mathématique.
Oui. Llama 3.2 3B Instruct a des open weights, donc vous pouvez le télécharger et l'exécuter sur votre propre GPU ou serveur avec des outils comme Ollama, vLLM ou llama.cpp — sans coût par token.