Les modèles Flash de vision-langage natifs Qwen3.5 sont construits sur une architecture hybride qui intègre un mécanisme d'attention linéaire avec un modèle de mélange d'experts sparse, atteignant une efficacité d'inférence supérieure.
Les prix se mettent à jour automatiquement — vérifiés quotidiennement par rapport aux prix catalogue des fournisseurs.
Artificial Analysis mesure 273 des 383 modèles suivis ici — celui-ci n'est pas encore couvert. La position tarifaire ci-dessus est mesurée sur l'ensemble du catalogue et ne dépend pas des référentiels.
Qwen3.5-Flash est un modèle d'IA open-weight d'Alibaba. Vous pouvez le télécharger et le déployer en self-hosted gratuitement ; les prix ci-dessous sont les prix de liste de l'API hébergée, suivis quotidiennement, pour quand vous préférez la commodité au self-hosting.
Qwen3.5-Flash est un modèle de langage IA de Alibaba. Il est open-weight : vous pouvez le télécharger et l'exécuter sur votre propre matériel, gratuitement.
Les poids sont gratuits et ouverts — vous pouvez auto-héberger Qwen3.5-Flash et ne rien payer par jeton. Si vous préférez une API hébergée, les prix sont de 0,07 $ par million de jetons d'entrée et de 0,26 $ par million de jetons de sortie.
Oui. Qwen3.5-Flash a des open weights, donc vous pouvez le télécharger et l'exécuter sur votre propre GPU ou serveur avec des outils comme Ollama, vLLM ou llama.cpp — sans coût par token.