Alibaba

AQwen3 Max ThinkingOPEN

Qwen3 Max Thinking (Alibaba): tarification API en direct, fenêtre de contexte et les meilleures alternatives open-source, suivies quotidiennement par olud.ai.

Fenêtre de contexte
262K
tokens
Prix d'entrée
$0.78
par M tokens
Prix de sortie
$3.9
par M tokens
Fournisseur
Alibaba

Les prix se mettent à jour automatiquement — vérifiés toutes les heures par rapport aux prix de la liste des fournisseurs.

Voir les comparaisons de modèles → Comparer tous les prix des modèles

Benchmarks & performance

Scores de référence indépendants pour Qwen3 Max Thinking, mesurés par Artificial Analysis. Plus c'est élevé, mieux c'est.

Intelligence index31.7
GPQA86.1%
Humanity's Last Exam26.2%
Long Context Reasoning66%
SciCode43.1%
IFBench70.7%
τ²-Bench83.6%
Terminal-Bench Hard24.2%
Données de benchmark par Artificial Analysis

À propos de ce modèle

Qwen3 Max Thinking est un modèle d'IA à poids ouvert d'Alibaba. Vous pouvez le télécharger et l'héberger vous-même gratuitement ; les prix ci-dessous sont les prix de liste de l'API hébergée, suivis à l'heure, pour lorsque vous préférez la commodité à l'auto-hébergement.

Questions fréquemment posées

Qu'est-ce que Qwen3 Max Thinking ?

Qwen3 Max Thinking est un modèle de langage IA de Alibaba. Il est à poids ouverts : vous pouvez le télécharger et l'exécuter sur votre propre matériel, gratuitement. Il obtient un score de 31.7 sur l'indice d'intelligence d'Artificial Analysis.

Qwen3 Max Thinking est-il gratuit ?

Les poids sont gratuits et ouverts — vous pouvez auto-héberger Qwen3 Max Thinking et ne rien payer par jeton. Si vous préférez une API hébergée, les prix sont de 0,78 $ par million de jetons d'entrée et de 3,9 $ par million de jetons de sortie.

Qu'est-ce que Qwen3 Max Thinking sait faire ?

Des benchmarks indépendants d'Artificial Analysis lui donnent GPQA 86.1%, Humanity's Last Exam 26.2%, Long Context Reasoning 66%, SciCode 43.1%, IFBench 70.7%, τ²-Bench 83.6%, Terminal-Bench Hard 24.2%.

Puis-je auto-héberger Qwen3 Max Thinking ?

Oui. Qwen3 Max Thinking a des poids ouverts, donc vous pouvez le télécharger et l'exécuter sur votre propre GPU ou serveur avec des outils comme Ollama, vLLM ou llama.cpp — sans coût par jeton.

Modèles associés

Qwen3.6 PlusAlibabaQwen3.7 PlusAlibabaQwen3.7 MaxAlibabaQwen3.5-FlashAlibabaQwen3.6 35B A3BAlibabaQwen3 235B A22B Instruct 2507Alibaba