Qwen3-32B est un modèle de langage causal dense de 32,8 milliards de paramètres de la série Qwen3, optimisé à la fois pour un raisonnement complexe et un dialogue efficace.
Les prix se mettent à jour automatiquement — vérifiés quotidiennement par rapport aux prix catalogue des fournisseurs.
Scores de référence indépendants pour Qwen3 32B, mesurés par Artificial Analysis. Plus c'est élevé, mieux c'est. Mode de mesure : Reasoning.
Qwen3 32B est un modèle d'IA open-weight d'Alibaba. Vous pouvez le télécharger et le déployer en self-hosted gratuitement ; les prix ci-dessous sont les prix de liste de l'API hébergée, suivis quotidiennement, pour quand vous préférez la commodité au self-hosting.
Qwen3 32B est un modèle de langage IA de Alibaba. Il est open-weight : vous pouvez le télécharger et l'exécuter sur votre propre matériel, gratuitement. Il obtient un score de 11.4 sur l'indice d'intelligence d'Artificial Analysis.
Les poids sont gratuits et ouverts — vous pouvez auto-héberger Qwen3 32B et ne rien payer par jeton. Si vous préférez une API hébergée, les prix sont de 0,08 $ par million de jetons d'entrée et de 0,28 $ par million de jetons de sortie.
Des benchmarks indépendants d'Artificial Analysis lui donnent GPQA 66.8%, MMLU-Pro 79.8%, Humanity's Last Exam 7.4%, Long Context Reasoning 0%, LiveCodeBench 54.6%, SciCode 35.4%, MATH-500 96.1%, AIME 80.7%, AIME 2025 73%, IFBench 36.3%, τ²-Bench 29.8%, τ-Bench Banking 5.4%, Terminal-Bench 5.2%, Terminal-Bench Hard 3%. Il est particulièrement utilisé pour génération de code.
Oui. Qwen3 32B a des open weights, donc vous pouvez le télécharger et l'exécuter sur votre propre GPU ou serveur avec des outils comme Ollama, vLLM ou llama.cpp — sans coût par token.