Olmo 3 32B Think est un modèle à grande échelle, avec 32 milliards de paramètres, conçu spécifiquement pour le raisonnement profond, les chaînes logiques complexes et les scénarios avancés de suivi des instructions.
Les prix se mettent à jour automatiquement — vérifiés quotidiennement par rapport aux prix catalogue des fournisseurs.
Scores de référence indépendants pour Olmo 3 32B Think, mesurés par Artificial Analysis. Plus c'est élevé, mieux c'est.
Olmo 3 32B Think est un modèle d'IA open-weight par AllenAI. Vous pouvez le télécharger et le self-host gratuitement ; les prix ci-dessous sont les prix catalogue des API hébergées, suivis quotidiennement, pour quand vous préférez la commodité au self-hosting.
Olmo 3 32B Think est un modèle de langage IA de AllenAI. Il est open-weight : vous pouvez le télécharger et l'exécuter sur votre propre matériel, gratuitement. Il obtient un score de 6.1 sur l'indice d'intelligence d'Artificial Analysis.
Les poids sont gratuits et ouverts — vous pouvez auto-héberger Olmo 3 32B Think et ne rien payer par token. Si vous préférez une API hébergée, les prix sont de 0,15 $ par million de tokens d'entrée et de 0,5 $ par million de tokens de sortie.
Des benchmarks indépendants d'Artificial Analysis lui donnent GPQA 61%, MMLU-Pro 75.9%, Humanity's Last Exam 6.4%, Long Context Reasoning 0%, LiveCodeBench 67.2%, SciCode 28.6%, AIME 2025 73.7%, IFBench 49.1%, τ²-Bench 0%, Terminal-Bench Hard 1.5%. Il est particulièrement utilisé pour raisonnement mathématique.
Oui. Olmo 3 32B Think a des open weights, vous pouvez donc le télécharger et l'exécuter sur votre propre GPU ou serveur avec des outils comme Ollama, vLLM ou llama.cpp — sans coût par jeton.