Alibaba · tutti i modelli ›

AQwen3.5-FlashOPEN

I modelli Flash di visione-linguaggio nativi Qwen3.5 sono costruiti su un'architettura ibrida che integra un meccanismo di attenzione lineare con un modello sparso di miscele di esperti, raggiungendo una maggiore efficienza di inferenza.

1MFinestra di contesto · token
$0.07Prezzo di input · per M token
$0.26Prezzo di output · per M token
AlibabaFornitore

I prezzi vengono aggiornati automaticamente — verificati quotidianamente rispetto ai listini prezzi dei fornitori.

Vedi confronti dei modelli → Confronta tutti i prezzi dei modelli

Benchmark

Artificial Analysis misura 273 dei 383 modelli tracciati qui — questo non è ancora coperto. La posizione di prezzo sopra è misurata su tutto il catalogo e non dipende dai benchmark.

Informazioni su questo modello

Qwen3.5-Flash è un modello AI open-weight di Alibaba. Puoi scaricarlo e self-hostarlo gratuitamente; i prezzi sottostanti sono i prezzi di listino delle API hosted, monitorati quotidianamente, per quando preferisci la comodità al self-hosting.

Domande frequenti

Che cos'è Qwen3.5-Flash?

Qwen3.5-Flash è un modello di linguaggio AI di Alibaba. È open-weight: può scaricarlo ed eseguirlo sul proprio hardware, gratuitamente.

Qwen3.5-Flash è gratuito?

I pesi sono gratuiti e aperti — puoi ospitare Qwen3.5-Flash da solo e non pagare nulla per token. Se preferisci un'API ospitata, i prezzi sono $0.07 per milione di token di input e $0.26 per milione di token di output.

Posso ospitare Qwen3.5-Flash da solo?

Sì. Qwen3.5-Flash ha open weights, quindi può essere scaricato e eseguito sulla propria GPU o server con strumenti come Ollama, vLLM o llama.cpp — senza costi per token.

Modelli correlati

Qwen3.8 MaxAlibabaQwen3.8 27BAlibabaQwen3.7 FlashAlibabaQwen3.6 35B A3BAlibabaQwen3.7 PlusAlibabaQwen3 235B A22B Instruct 2507Alibaba