Los modelos nativos de visión-lenguaje Flash de Qwen3.5 están construidos sobre una arquitectura híbrida que integra un mecanismo de atención lineal con un modelo de mezcla de expertos disperso, logrando una mayor eficiencia de inferencia.
Los precios se actualizan automáticamente; se verifican a diario contra las tarifas oficiales de los proveedores.
Artificial Analysis mide 273 de los 383 modelos rastreados aquí — este aún no está cubierto. La posición de precios anterior se mide a través de todo el catálogo y no depende de las referencias.
Qwen3.5-Flash es un modelo de IA open-weight de Alibaba. Puede descargarlo y alojarlo usted mismo (self-host) de forma gratuita; los precios a continuación son precios de lista de API alojada, rastreados a diario, para cuando prefiera la comodidad sobre el self-hosting.
Qwen3.5-Flash es un modelo de lenguaje de IA de Alibaba. Es open-weight: puede descargarlo y ejecutarlo en su propio hardware, de forma gratuita.
Los pesos son gratuitos y abiertos — puedes autoalojar Qwen3.5-Flash y no pagar nada por token. Si prefieres una API alojada, los precios son $0.07 por millón de tokens de entrada y $0.26 por millón de tokens de salida.
Sí. Qwen3.5-Flash tiene open weights, por lo que puede descargarlo y ejecutarlo en su propia GPU o servidor con herramientas como Ollama, vLLM o llama.cpp — sin costo por token.