Qwen3-Next-80B-A3B-Thinking est un modèle de chat axé sur le raisonnement dans la ligne Qwen3-Next qui produit par défaut des traces de « pensée » structurées.
Les prix se mettent à jour automatiquement — vérifiés quotidiennement par rapport aux prix catalogue des fournisseurs.
Scores de référence indépendants pour Qwen3 Next 80B A3B Thinking, mesurés par Artificial Analysis. Plus c'est élevé, mieux c'est. Mode de mesure : Reasoning.
Qwen3 Next 80B A3B Thinking est un modèle d'IA open-weight par Alibaba. Vous pouvez le télécharger et le self-host gratuitement ; les prix ci-dessous sont les prix catalogue des API hébergées, suivis quotidiennement, pour quand vous préférez la commodité au self-hosting.
Qwen3 Next 80B A3B Thinking est un modèle de langage IA de Alibaba. Il est open-weight : vous pouvez le télécharger et l'exécuter sur votre propre matériel, gratuitement. Il obtient un score de 16.9 sur l'indice d'intelligence d'Artificial Analysis.
Les poids sont gratuits et ouverts — vous pouvez auto-héberger Qwen3 Next 80B A3B Thinking et ne rien payer par token. Si vous préférez une API hébergée, les prix sont de 0,15 $ par million de tokens d'entrée et de 1,2 $ par million de tokens de sortie.
Des benchmarks indépendants d'Artificial Analysis lui donnent GPQA 75.9%, MMLU-Pro 82.4%, Humanity's Last Exam 12.6%, Long Context Reasoning 62%, LiveCodeBench 78.4%, SciCode 38.8%, AIME 2025 84.3%, IFBench 60.7%, τ²-Bench 41.5%, τ-Bench Banking 6.2%, Terminal-Bench 6.7%, Terminal-Bench Hard 9.8%. Il est particulièrement utilisé pour génération de code.
Il génère environ 180.7 tokens par seconde, avec un délai médian 1.09s avant le premier token. Mesuré indépendamment par Artificial Analysis.
Oui. Qwen3 Next 80B A3B Thinking a des open weights, donc vous pouvez le télécharger et l'exécuter sur votre propre GPU ou serveur avec des outils comme Ollama, vLLM ou llama.cpp — sans coût par jeton.