Os modelos Flash de visão-linguagem nativos do Qwen3.5 são construídos em uma arquitetura híbrida que integra um mecanismo de atenção linear com um modelo de mistura de especialistas esparso, alcançando maior eficiência de inferência.
Os preços são atualizados automaticamente — verificados diariamente em relação aos preços de lista dos provedores.
A Artificial Analysis mede 273 dos 383 modelos rastreados aqui — este ainda não está coberto. A posição de preço acima é medida em todo o catálogo e não depende de benchmarks.
Qwen3.5-Flash é um modelo de IA open-weight da Alibaba. Você pode baixá-lo e fazer self-host gratuitamente; os preços abaixo são preços de lista de API hospedada, rastreados diariamente, para quando você preferir conveniência em vez de self-hosting.
Qwen3.5-Flash é um modelo de linguagem de IA da Alibaba. É open-weight: você pode baixá-lo e executá-lo em seu próprio hardware, gratuitamente.
Os pesos são gratuitos e abertos — você pode auto-hospedar o Qwen3.5-Flash e não pagar nada por token. Se preferir uma API hospedada, os preços são $0.07 por milhão de tokens de entrada e $0.26 por milhão de tokens de saída.
Sim. Qwen3.5-Flash tem open weights, então você pode baixá-lo e executá-lo em sua própria GPU ou servidor com ferramentas como Ollama, vLLM ou llama.cpp — sem custo por token.