Qwen3-30B-A3B-Thinking-2507 est un modèle de raisonnement Mixture-of-Experts de 30B paramètres optimisé pour des tâches complexes nécessitant une réflexion multi-étapes prolongée.
Les prix se mettent à jour automatiquement — vérifiés quotidiennement par rapport aux prix catalogue des fournisseurs.
Scores de référence indépendants pour Qwen3 30B A3B Thinking 2507, mesurés par Artificial Analysis. Plus c'est élevé, mieux c'est. Mode de mesure : Reasoning.
Qwen3 30B A3B Thinking 2507 est un modèle d'IA open-weight d'Alibaba. Vous pouvez le télécharger et le self-hoster gratuitement ; les prix ci-dessous sont les prix catalogue des API hébergées, suivis quotidiennement, pour quand vous préférez la commodité au self-hosting.
Qwen3 30B A3B Thinking 2507 est un modèle de langage IA de Alibaba. Il est open-weight : vous pouvez le télécharger et l'exécuter sur votre propre matériel, gratuitement. Il obtient un score de 14.6 sur l'indice d'intelligence d'Artificial Analysis.
Les poids sont gratuits et ouverts — vous pouvez auto-héberger Qwen3 30B A3B Thinking 2507 et ne rien payer par token. Si vous préférez une API hébergée, les prix de liste sont de 0,2 $ par million de tokens d'entrée et de 2,4 $ par million de tokens de sortie.
Des benchmarks indépendants d'Artificial Analysis lui donnent GPQA 70.7%, MMLU-Pro 80.5%, Humanity's Last Exam 10.3%, Long Context Reasoning 59.7%, LiveCodeBench 70.7%, SciCode 33.3%, MATH-500 97.6%, AIME 90.7%, AIME 2025 56.3%, IFBench 50.7%, τ²-Bench 28.1%, τ-Bench Banking 5.4%, Terminal-Bench 1.5%, Terminal-Bench Hard 5.3%. Il est particulièrement utilisé pour génération de code.
Oui. Qwen3 30B A3B Thinking 2507 a des open weights, donc vous pouvez le télécharger et l'exécuter sur votre propre GPU ou serveur avec des outils comme Ollama, vLLM ou llama.cpp — sans coût par token.