Alibaba · alle Modelle ›

AQwen3.5-FlashOPEN

Die Qwen3.5 nativen Vision-Language Flash-Modelle basieren auf einer hybriden Architektur, die einen linearen Aufmerksamkeitsmechanismus mit einem spärlichen Mischmodell von Experten integriert und eine höhere Inferenz-Effizienz erreicht.

1MKontextfenster · Tokens
$0.07Eingabepreis · pro M Tokens
$0.26Ausgabepreis · pro M Tokens
AlibabaAnbieter

Preise werden automatisch aktualisiert — täglich geprüft anhand der Listenpreise der Anbieter.

Siehe Modellvergleiche → Vergleiche alle Modellpreise

Benchmarks

Artificial Analysis misst 273 der 383 Modelle, die hier verfolgt werden — dieses ist noch nicht abgedeckt. Die oben angegebene Preisposition wird über den gesamten Katalog gemessen und hängt nicht von Benchmarks ab.

Über dieses Modell

Qwen3.5-Flash ist ein Open-Weight-KI-Modell von Alibaba. Sie können es kostenlos herunterladen und selbst hosten; die unten aufgeführten Preise sind die Listenpreise für gehostete APIs, die täglich aktualisiert werden, für den Fall, dass Sie Komfort dem Selbsthosten vorziehen.

Häufig gestellte Fragen

Was ist Qwen3.5-Flash?

Qwen3.5-Flash ist ein KI-Sprachmodell von Alibaba. Es ist open-weight: Sie können es herunterladen und auf Ihrer eigenen Hardware kostenlos ausführen.

Ist Qwen3.5-Flash kostenlos?

Die Gewichte sind kostenlos und offen — Sie können Qwen3.5-Flash selbst hosten und zahlen nichts pro Token. Wenn Sie eine gehostete API bevorzugen, liegen die Listenpreise bei $0.07 pro Million Eingabetokens und $0.26 pro Million Ausgabetokens.

Kann ich Qwen3.5-Flash selbst hosten?

Ja. Qwen3.5-Flash hat open weights, sodass Sie es herunterladen und auf Ihrer eigenen GPU oder Ihrem Server mit Tools wie Ollama, vLLM oder llama.cpp ausführen können — ohne Kosten pro Token.

Verwandte Modelle

Qwen3.8 MaxAlibabaQwen3.8 27BAlibabaQwen3.7 FlashAlibabaQwen3.6 35B A3BAlibabaQwen3.7 PlusAlibabaQwen3 235B A22B Instruct 2507Alibaba