Alibaba · todos los modelos ›

AQwen3.5-FlashOPEN

Los modelos nativos de visión-lenguaje Flash de Qwen3.5 están construidos sobre una arquitectura híbrida que integra un mecanismo de atención lineal con un modelo de mezcla de expertos disperso, logrando una mayor eficiencia de inferencia.

1MVentana de contexto · tokens
$0.07Precio de entrada · por M tokens
$0.26Precio de salida · por M tokens
AlibabaProveedor

Los precios se actualizan automáticamente; se verifican a diario contra las tarifas oficiales de los proveedores.

Ver comparaciones de modelos → Comparar todos los precios de modelos

Referencias

Artificial Analysis mide 273 de los 383 modelos rastreados aquí — este aún no está cubierto. La posición de precios anterior se mide a través de todo el catálogo y no depende de las referencias.

Acerca de este modelo

Qwen3.5-Flash es un modelo de IA open-weight de Alibaba. Puede descargarlo y alojarlo usted mismo (self-host) de forma gratuita; los precios a continuación son precios de lista de API alojada, rastreados a diario, para cuando prefiera la comodidad sobre el self-hosting.

Preguntas frecuentes

¿Qué es Qwen3.5-Flash?

Qwen3.5-Flash es un modelo de lenguaje de IA de Alibaba. Es open-weight: puede descargarlo y ejecutarlo en su propio hardware, de forma gratuita.

¿Es Qwen3.5-Flash gratis?

Los pesos son gratuitos y abiertos — puedes autoalojar Qwen3.5-Flash y no pagar nada por token. Si prefieres una API alojada, los precios son $0.07 por millón de tokens de entrada y $0.26 por millón de tokens de salida.

¿Puedo autoalojar Qwen3.5-Flash?

Sí. Qwen3.5-Flash tiene open weights, por lo que puede descargarlo y ejecutarlo en su propia GPU o servidor con herramientas como Ollama, vLLM o llama.cpp — sin costo por token.

Modelos relacionados

Qwen3.8 MaxAlibabaQwen3.8 27BAlibabaQwen3.7 FlashAlibabaQwen3.6 35B A3BAlibabaQwen3.7 PlusAlibabaQwen3 235B A22B Instruct 2507Alibaba