Qwen3.8 2.4T A95B est un modèle open-weight sparse mixture-of-experts de Qwen et la variante open-weight de Qwen3.8 Max, avec 95 milliards de paramètres actifs sur un total de 2.4 billions.
Les prix se mettent à jour automatiquement — vérifiés quotidiennement par rapport aux prix catalogue des fournisseurs.
Scores de benchmark indépendants pour Qwen3.8 2.4T A95B, mesurés par Artificial Analysis. Plus le score est élevé, mieux c'est.
Qwen3.8 2.4T A95B est un modèle d'IA open-weight d'Alibaba. Vous pouvez le télécharger et le self-host gratuitement ; les prix ci-dessous sont les prix catalogue des API hébergées, suivis quotidiennement, pour quand vous préférez la commodité au self-hosting.
Qwen3.8 2.4T A95B est un modèle de langage IA de Alibaba. Il est open-weight : vous pouvez le télécharger et l'exécuter sur votre propre matériel, gratuitement. Il obtient un score de 57.7 sur l'indice d'intelligence d'Artificial Analysis.
Les poids sont libres et ouverts — vous pouvez self-host Qwen3.8 2.4T A95B et ne rien payer par token. Si vous préférez une API hébergée, les prix catalogue sont 2 $ par million de tokens d'entrée et 6 $ par million de tokens de sortie.
Des benchmarks indépendants d'Artificial Analysis lui donnent GPQA 93.5%, Humanity's Last Exam 42.4%, Long Context Reasoning 75.3%, SciCode 51.6%, τ-Bench Banking 49.1%, Terminal-Bench 82%. Il est particulièrement utilisé pour génération de code.
Il génère environ 23.8 tokens par seconde, avec un délai médian 1.72s avant le premier token. Mesuré indépendamment par Artificial Analysis.
Oui. Qwen3.8 2.4T A95B a des open weights, donc vous pouvez le télécharger et l'exécuter sur votre propre GPU ou serveur avec des outils comme Ollama, vLLM ou llama.cpp — sans coût par token.