La série Qwen3.5 35B-A3B est un modèle natif de vision-langage conçu avec une architecture hybride qui intègre des mécanismes d'attention linéaire et un modèle de mélange d'experts sparse, atteignant une efficacité d'inférence supérieure.
Les prix se mettent à jour automatiquement — vérifiés quotidiennement par rapport aux prix catalogue des fournisseurs.
Scores de référence indépendants pour Qwen3.5-35B-A3B, mesurés par Artificial Analysis. Plus c'est élevé, mieux c'est. Mode de mesure : Reasoning.
Qwen3.5-35B-A3B est un modèle d'IA open-weight d'Alibaba. Vous pouvez le télécharger et le déployer en self-hosted gratuitement ; les prix ci-dessous sont les prix de liste de l'API hébergée, suivis quotidiennement, pour quand vous préférez la commodité au self-hosting.
Qwen3.5-35B-A3B est un modèle de langage IA de Alibaba. Il est open-weight : vous pouvez le télécharger et l'exécuter sur votre propre matériel, gratuitement. Il obtient un score de 29.9 sur l'indice d'intelligence d'Artificial Analysis.
Les poids sont libres et ouverts — vous pouvez self-host Qwen3.5-35B-A3B et ne rien payer par token. Si vous préférez une API hébergée, les tarifs sont de $0.25 par million de tokens d'entrée et $1.25 par million de tokens de sortie.
Des benchmarks indépendants d'Artificial Analysis lui donnent GPQA 84.5%, Humanity's Last Exam 21%, Long Context Reasoning 68.3%, SciCode 37.7%, IFBench 72.5%, τ²-Bench 89.2%, Terminal-Bench Hard 26.5%.
Oui. Qwen3.5-35B-A3B a des open weights, donc vous pouvez le télécharger et l'exécuter sur votre propre GPU ou serveur avec des outils comme Ollama, vLLM ou llama.cpp — sans coût par token.