Qwen3.8 Max est le modèle phare de la série Qwen3.8 d'Alibaba, le successeur en disponibilité générale du Qwen3.8 Max Preview.
Les prix se mettent à jour automatiquement — vérifiés quotidiennement par rapport aux prix catalogue des fournisseurs.
Scores de référence indépendants pour Qwen3.8 Max, mesurés par Artificial Analysis. Plus c'est élevé, mieux c'est.
Qwen3.8 Max est un modèle d'IA open-weight d'Alibaba. Vous pouvez le télécharger et le déployer en self-hosted gratuitement ; les prix ci-dessous sont les prix de liste de l'API hébergée, suivis quotidiennement, pour quand vous préférez la commodité au self-hosting.
Qwen3.8 Max est un modèle de langage IA de Alibaba. Il est open-weight : vous pouvez le télécharger et l'exécuter sur votre propre matériel, gratuitement. Il obtient un score de 58.1 sur l'indice d'intelligence d'Artificial Analysis.
Les weights sont gratuits et ouverts — vous pouvez auto-héberger Qwen3.8 Max et ne rien payer par token. Si vous préférez une API hébergée, les prix de liste sont de 2 $ par million de tokens d'entrée et de 6 $ par million de tokens de sortie.
Des benchmarks indépendants d'Artificial Analysis lui donnent GPQA 92.7%, Humanity's Last Exam 43%, Long Context Reasoning 74.3%, SciCode 52.9%, τ-Bench Banking 51.3%, Terminal-Bench 81.3%. Il est particulièrement utilisé pour génération de code.
Il génère environ 25.7 tokens par seconde, avec un délai médian 1.76s avant le premier token. Mesuré indépendamment par Artificial Analysis.
Oui. Qwen3.8 Max a des open weights, donc vous pouvez le télécharger et l'exécuter sur votre propre GPU ou serveur avec des outils comme Ollama, vLLM ou llama.cpp — sans coût par token.