Zwei Drittel der bezahlten KI-Modelle werden von einem günstigeren Modell desselben Anbieters übertroffen
Von den 76 geschlossenen Modellen, die wir bewerten und einstufen, werden 50 von einem anderen Modell der gleichen Firma übertroffen, das auch weniger kostet — weniger bei der Eingabe und weniger bei der Ausgabe. Niemand sendet Ihnen eine E-Mail, wenn das passiert.
TL;DR — die kurze Version
50 der 76 geschlossenen Modelle, die wir verfolgen, werden von einem stabilen Modell dominiert. Gleicher Anbieter, höhere Intelligenzbewertung, niedrigerer Preis für sowohl Eingabe als auch Ausgabe. Das sind 66 %.
Die größte Lücke beträgt 20×. o1-pro wird weiterhin mit 600 $ pro Million Ausgabetokens gelistet. GPT-5.6 Solvon derselben Firma kostet 30 $ und erzielt 40 Punkte mehr.
Sechs der 50 werden von dem eigenen open-weight Modell ihres Anbieters übertroffen. Die günstigere, bessere Option ist eine, die Sie herunterladen können.
Eine Preisliste für APIs ist keine Empfehlung. Es ist ein Archiv. Anbieter fügen ständig Modelle hinzu und ziehen sie fast nie zurück, sodass der Endpunkt, den Sie vor achtzehn Monaten verkabelt haben, in der Dokumentation neben seinem eigenen Ersatz, zu seinem ursprünglichen Preis, unbegrenzt bleibt.
Wir bewerten und einstufen jedes Modell im Katalog jeden Morgen. Daher haben wir eine mechanische Frage gestellt, die keinen Raum für Meinungen lässt: Verkauft derselbe Anbieter für jedes kostenpflichtige Modell etwas, das in unserem Intelligenzindex höher bewertet wird und kostet weniger pro Million Tokens bei der Eingabe und bei der Ausgabe?
Nicht günstiger im Durchschnitt. Nicht besser bei einem Benchmark. Streng besser und streng günstiger auf jeder Achse gleichzeitig — der Fall, in dem es keinen Kompromiss mehr gibt, über den man diskutieren könnte.
Die Antwort, am 2. August 2026: 50 von 76.
Der 20× Fall
Die größte Lücke im Katalog gehört OpenAI. o1-pro wird weiterhin mit 150 $ bei der Eingabe und 600 $ bei der Ausgabe pro Million Tokens gelistet. GPT-5.6 Solvon demselben Anbieter kostet 5 $ bei der Eingabe und 30 $ bei der Ausgabe — und erzielt 58.9 in unserem Intelligenzindex im Vergleich zu o1-pros 18.9.
Dreißigmal günstiger bei der Eingabe, zwanzigmal günstiger bei der Ausgabe, vierzig Punkte höher. Es gibt keine Arbeitslast, bei der o1-pro heute die richtige Antwort ist, und dennoch sagt nichts auf OpenAIs Preisseite das Gegenteil.
Ein Vorbehalt, den wir Ihnen schulden: o1-pro hat in unseren Daten keinen Programmierwert, daher machen wir keine Aussage über seine Programmierfähigkeit. Der Intelligenzindex ist das, was wir gemessen haben, und darauf basiert der Vergleich.
Es ist nicht nur OpenAI
Das Muster gilt überall, wo ein Anbieter schnell liefert. Anthropics Claude Opus 4.7 (Fast) wird mit 30 $ bei der Eingabe und 150 $ bei der Ausgabe gelistet. Claude Opus 5 kostet 5 $ und 25 $ — sechs Mal weniger bei der Ausgabe — und erzielt 60.7 im Vergleich zu 53.5.
Im gesamten Katalog verteilen sich die 50 dominierten Modelle wie folgt:
| Anbieter | Modelle, die von einem günstigeren stabilen Modell übertroffen werden |
|---|---|
| OpenAI | 33 |
| Anthropic | 10 |
| 6 | |
| Perplexity | 1 |
OpenAI dominiert diese Tabelle teilweise, weil es den längsten Katalog hat — die Familien o1, o3, o4 und GPT-5.x coexistieren alle. Die Anzahl der Veröffentlichungen ist die Ursache, nicht Nachlässigkeit. Aber die Auswirkungen auf die Rechnung eines Kunden sind in beiden Fällen identisch.
Sechsmal ist die Antwort ein open-weight Modell
Sechs der 50 werden nur von einem Modell übertroffen, das ihr eigener Anbieter mit open weights veröffentlicht hat. Googles Gemini 2.5 Flash ist eins: $0.30 rein, $2.50 raus, 14.1 im Index. Googles eigene Gemma 4 31B liegt bei $0.10 und $0.34 beim günstigsten Anbieter und erzielt 29.4.
Das ist eine seltsame Sache, die in einer Preisliste enthalten ist. Der Anbieter verkauft Ihnen eine API für ein Modell, das seine eigene kostenlose Download-Version um den Preis von einem Siebtel übertrifft. Es ist auch, wenn Sie die Rechnung führen, die einfachste Einsparung auf dieser Seite: die Gewichte sind öffentlich, sodass Sie sie selbst hosten oder jeden Anbieter Ihrer Wahl auswählen können.
Was tatsächlich zu tun ist
- Überprüfen Sie das Modell, das Sie festgelegt haben, nicht das, über das Sie gelesen haben. Die meisten dieser 50 sind noch irgendwo in Produktion, in Code geschrieben, als sie die besten verfügbaren waren.
- Achten Sie auf die Mittelklassefalle. Sieben Modelle — die Familien o3 Mini, o4 Mini und GPT-5.4 Mini — werden geschlagen von GPT-5.6 Luna bei $0.10 / $0.60. Klein und alt ist nicht dasselbe wie billig.
- Gehen Sie nicht davon aus, dass das Flaggschiff das beste Modell ist, das der Anbieter verkauft. In diesen Maßstäben ist es häufig nicht der Fall.
Sie können den Vergleich selbst für zwei beliebige Modelle im Katalog von der Modellvergleichsseitedurchführen, oder durchstöbern Sie die vollständige Rangliste.
Methode, sodass Sie damit argumentieren können
Preise sind Dollar pro Million Tokens, wie vom Anbieter für geschlossene Modelle veröffentlicht, und wie vom günstigsten verfügbaren Anbieter für open-weight Modelle aufgeführt. Intelligenz ist unser täglicher Benchmark-Fusion, die jeden Morgen neu erstellt wird; die obigen Zahlen stammen aus der Datei, die am 2. August 2026 generiert wurde und werden sich ändern, wenn Modelle hinzugefügt werden.
Wir haben absichtlich zwei Dinge ausgeschlossen. Kostenlose Stufen, da ein Preis von $0 jedes Verhältnis unendlich macht und Ihnen nichts sagt. Batch-Preise, da eine Batch-Stufe ein Rabatt auf dasselbe Modell ist, nicht ein anderes Produkt — dies zu zählen hätte das Ergebnis auf 69 von 103 aufgebläht. Die strengere Zahl, 50 von 76, ist die, hinter der wir stehen.
Jede Zahl hier wird täglich neu berechnet. Wenn ein Anbieter morgen einen Preis senkt, verlässt das Modell diese Liste, und die Rangliste wird es zeigen, bevor wir es tun.