Das Qwen3.5 122B-A10B native Vision-Language-Modell basiert auf einer hybriden Architektur, die einen linearen Aufmerksamkeitsmechanismus mit einem spärlichen Mischmodell von Experten integriert und eine höhere Inferenz-Effizienz erreicht.
Preise werden automatisch aktualisiert — täglich geprüft anhand der Listenpreise der Anbieter.
Unabhängige Benchmark-Ergebnisse für Qwen3.5-122B-A10B, gemessen von Artificial Analysis. Höher ist besser. Messmodus: Reasoning.
Qwen3.5-122B-A10B ist ein Open-Weight-KI-Modell von Alibaba. Sie können es kostenlos herunterladen und selbst hosten; die unten angegebenen Preise sind die täglich aktualisierten Listenpreise der gehosteten APIs, für den Fall, dass Sie Bequemlichkeit dem Selbsthosten vorziehen.
Qwen3.5-122B-A10B ist ein KI-Sprachmodell von Alibaba. Es ist open-weight: Sie können es herunterladen und auf Ihrer eigenen Hardware kostenlos ausführen. Es erzielt 32.8 im Artificial Analysis Intelligenzindex.
Die Gewichte sind kostenlos und offen — Sie können Qwen3.5-122B-A10B selbst hosten und zahlen nichts pro Token. Wenn Sie eine gehostete API bevorzugen, betragen die Listenpreise 0,26 $ pro Million Eingabetokens und 2,08 $ pro Million Ausgabetokens.
Unabhängige Benchmarks von Artificial Analysis geben ihm GPQA 85.7%, Humanity's Last Exam 25.2%, Long Context Reasoning 70.3%, SciCode 42%, IFBench 75.7%, τ²-Bench 93.6%, τ-Bench Banking 15.3%, Terminal-Bench 47.6%, Terminal-Bench Hard 31.1%. Es wird besonders verwendet für Code-Generierung.
Es generiert etwa 138.8 Tokens pro Sekunde, mit einer Median 1.01s Verzögerung vor dem ersten Token. Unabhängig von Artificial Analysis gemessen.
Ja. Qwen3.5-122B-A10B hat open weights, sodass Sie es herunterladen und auf Ihrer eigenen GPU oder Ihrem Server mit Tools wie Ollama, vLLM oder llama.cpp ausführen können — ohne Kosten pro Token.