Alibaba · tous les modèles ›

AQwen3.5-FlashOPEN

Les modèles Flash de vision-langage natifs Qwen3.5 sont construits sur une architecture hybride qui intègre un mécanisme d'attention linéaire avec un modèle de mélange d'experts sparse, atteignant une efficacité d'inférence supérieure.

1MFenêtre de contexte · tokens
$0.07Prix d'entrée · par M tokens
$0.26Prix de sortie · par M tokens
AlibabaFournisseur

Les prix se mettent à jour automatiquement — vérifiés quotidiennement par rapport aux prix catalogue des fournisseurs.

Voir les comparaisons de modèles → Comparer tous les prix des modèles

Référentiels

Artificial Analysis mesure 273 des 383 modèles suivis ici — celui-ci n'est pas encore couvert. La position tarifaire ci-dessus est mesurée sur l'ensemble du catalogue et ne dépend pas des référentiels.

À propos de ce modèle

Qwen3.5-Flash est un modèle d'IA open-weight d'Alibaba. Vous pouvez le télécharger et le déployer en self-hosted gratuitement ; les prix ci-dessous sont les prix de liste de l'API hébergée, suivis quotidiennement, pour quand vous préférez la commodité au self-hosting.

Questions fréquemment posées

Qu'est-ce que Qwen3.5-Flash ?

Qwen3.5-Flash est un modèle de langage IA de Alibaba. Il est open-weight : vous pouvez le télécharger et l'exécuter sur votre propre matériel, gratuitement.

Qwen3.5-Flash est-il gratuit ?

Les poids sont gratuits et ouverts — vous pouvez auto-héberger Qwen3.5-Flash et ne rien payer par jeton. Si vous préférez une API hébergée, les prix sont de 0,07 $ par million de jetons d'entrée et de 0,26 $ par million de jetons de sortie.

Puis-je auto-héberger Qwen3.5-Flash ?

Oui. Qwen3.5-Flash a des open weights, donc vous pouvez le télécharger et l'exécuter sur votre propre GPU ou serveur avec des outils comme Ollama, vLLM ou llama.cpp — sans coût par token.

Modèles associés

Qwen3.8 MaxAlibabaQwen3.8 27BAlibabaQwen3.7 FlashAlibabaQwen3.6 35B A3BAlibabaQwen3.7 PlusAlibabaQwen3 235B A22B Instruct 2507Alibaba