gpt-oss-120b ist ein open-weight, 117B-Parameter Mixture-of-Experts (MoE) Sprachmodell von OpenAI, das für hochgradige, agentische und allgemeine Produktionsanwendungsfälle entwickelt wurde.
Preise werden automatisch aktualisiert — täglich geprüft anhand der Listenpreise der Anbieter.
Unabhängige Benchmark-Ergebnisse für gpt-oss-120b, gemessen von Artificial Analysis. Höher ist besser. Messmodus: high.
gpt-oss-120b ist ein open-weight KI-Modell von OpenAI. Sie können es kostenlos herunterladen und self-hosted betreiben; die unten aufgeführten Preise sind die Listenpreise der gehosteten API, die täglich aktualisiert werden, für den Fall, dass Sie den Komfort dem Self-Hosting vorziehen.
gpt-oss-120b ist ein KI-Sprachmodell von OpenAI. Es ist open-weight: Sie können es herunterladen und auf Ihrer eigenen Hardware kostenlos ausführen. Es erzielt 24.1 im Artificial Analysis Intelligenzindex.
Die Gewichte sind kostenlos und offen — Sie können gpt-oss-120b selbst hosten und zahlen nichts pro Token. Wenn Sie eine gehostete API bevorzugen, liegen die Listenpreise bei 0,04 $ pro Million Eingabetokens und 0,17 $ pro Million Ausgabetokens.
Unabhängige Benchmarks von Artificial Analysis geben ihm GPQA 78.2%, MMLU-Pro 80.8%, Humanity's Last Exam 19.6%, Long Context Reasoning 51%, LiveCodeBench 87.8%, SciCode 38.9%, AIME 2025 93.4%, IFBench 69%, τ²-Bench 65.8%, τ-Bench Banking 12.8%, Terminal-Bench 26.2%, Terminal-Bench Hard 23.5%. Es wird besonders verwendet für Code-Generierung.
Es generiert etwa 167.3 Tokens pro Sekunde, mit einer Median 0.53s Verzögerung vor dem ersten Token. Unabhängig von Artificial Analysis gemessen.
Ja. gpt-oss-120b hat open weights, sodass Sie es herunterladen und auf Ihrer eigenen GPU oder Ihrem Server mit Tools wie Ollama, vLLM oder llama.cpp ausführen können — ohne Kosten pro Token.