Qwen3.8 2.4T A95B ist ein Open-Weight-Sparse-Mixture-of-Experts-Modell von Qwen und die Open-Weight-Variante von Qwen3.8 Max, mit 95 Milliarden aktiven Parametern von insgesamt 2.4 Billionen.
Preise werden automatisch aktualisiert — täglich geprüft anhand der Listenpreise der Anbieter.
Unabhängige Benchmark-Ergebnisse für Qwen3.8 2.4T A95B, gemessen von Artificial Analysis. Höher ist besser.
Qwen3.8 2.4T A95B ist ein Open-Weight-KI-Modell von Alibaba. Sie können es kostenlos herunterladen und selbst hosten; die unten aufgeführten Preise sind Listenpreise für gehostete APIs, die täglich aktualisiert werden, für den Fall, dass Sie Bequemlichkeit dem Selbsthosten vorziehen.
Qwen3.8 2.4T A95B ist ein KI-Sprachmodell von Alibaba. Es ist open-weight: Sie können es herunterladen und auf Ihrer eigenen Hardware kostenlos ausführen. Es erzielt 57.7 im Artificial Analysis Intelligenzindex.
Die Gewichte sind kostenlos und offen — Sie können Qwen3.8 2.4T A95B selbst hosten und zahlen nichts pro Token. Wenn Sie eine gehostete API bevorzugen, liegen die Listenpreise bei $2 pro Million Input-Token und $6 pro Million Output-Token.
Unabhängige Benchmarks von Artificial Analysis geben ihm GPQA 93.5%, Humanity's Last Exam 42.4%, Long Context Reasoning 75.3%, SciCode 51.6%, τ-Bench Banking 49.1%, Terminal-Bench 82%. Es wird besonders verwendet für Code-Generierung.
Es generiert etwa 23.8 Tokens pro Sekunde, mit einer Median 1.72s Verzögerung vor dem ersten Token. Unabhängig von Artificial Analysis gemessen.
Ja. Qwen3.8 2.4T A95B hat open weights, sodass Sie es herunterladen und auf Ihrer eigenen GPU oder Ihrem eigenen Server mit Tools wie Ollama, vLLM oder llama.cpp ausführen können — ohne Kosten pro Token.