KI-Tools Projekte Verzeichnis
🏆 Rangliste 📡 Nachrichten ✨ Eingabeaufforderungen ⚖️ Modelle vergleichen 🔧 Werkzeuge 📦 Projekte 🚀 Räume
Blog
Modellvergleich

Opus 5 gegen Fable 5 — neuer, besser, halb so teuer

Claude Opus 5 wurde fünfundvierzig Tage nach Claude Fable 5 veröffentlicht. Es erzielt höhere Werte in beiden zusammengesetzten Indizes und kostet genau die Hälfte pro Token. Das sollte nicht passieren, und der Grund dafür ist interessanter als das Ranking.

Aktualisiert am 28. Juli 2026·9 Min Lesezeit·Keine Bezahlschranke

TL;DR — die kurze Version

Opus 5 erzielt 60.7 in Intelligenz und 78.0 im Programmieren für $5 rein und $25 raus pro Million Tokens. Fable 5 erzielt 59.9 und 76.5 für $10 rein und $50 raus. Gleicher Anbieter, neueres Modell, 2× der Preis für weniger Punkte.

Fable 5 wird nicht überall geschlagen. Es ist schneller im nachhaltigen Durchsatz mit 71.3 Tokens pro Sekunde gegenüber 62.8 und gewinnt Humanity’s Last Exam und SciCode eindeutig.

Die Einstellung ist wichtiger als das Modell. Opus 5 erzielt bei mittlerem Aufwand bereits 56.3, über Opus 4.8 bei maximalem Aufwand, und beginnt, in 9.83 Sekunden statt in 37.44 zu antworten. Dieser Regler beeinflusst Ihre Latenz und Ihre Kosten mehr als die Wahl zwischen diesen beiden Modellen.

Die beiden Modelle, nebeneinander

Beide Zahlen unten stammen aus dem gleichen täglichen Snapshot, der um 05:30 am 28. Juli 2026 über 874 gemessene Modelle gelesen wurde. Intelligence und Coding sind zusammengesetzte Indizes von Artificial Analysis; Durchsatz, Zeit bis zum ersten Token und Preis verfolgen wir parallel dazu. Preise sind Dollar pro Million Tokens.

MetrikClaude Opus 5Claude Fable 5
Veröffentlicht24. Juli 20269. Juni 2026
Intelligenz60.759.9
Programmierung78.076.5
$ / 1M Eingabe$5$10
$ / 1M Ausgabe$25$50
Tokens / s62.871.3
Zeit bis zum ersten Token31.35 s80.07 s

Die Preiskurve ist es wert, zweimal gelesen zu werden. Es ist nicht grob die Hälfte, es ist genau die Hälfte: $5 gegen $10 bei der Eingabe, $25 gegen $50 bei der Ausgabe. Nichts in den beiden Punktzahlen-Spalten rechtfertigt dieses Verhältnis — die Lücke beträgt 0.8 Punkte Intelligenz und 1.5 Punkte Coding, beide zugunsten des günstigeren Modells.

Claude Opus 5 versus Claude Fable 5: intelligence score and output price per million tokens
Zwei Modelle vom gleichen Anbieter, fünfundvierzig Tage auseinander. Täglich aus Live-Preisen neu gezeichnet.

Eine Einschränkung vor den Benchmarks: Beide Modelle laufen mit einer adaptiven Denkweise, daher ist keines ein einfaches Ein-Pass-Modell. Die Opus 5-Spalte ist ihre Maximalaufwandeinstellung, eine von fünf, die wir verfolgen; Fable 5 hat eine einzige gemessene Konfiguration, die 59.9 erzielt. Dieser letzte Punkt wird weiter unten das gesamte Argument.

Die Benchmark-Aufteilung ist nicht einseitig

Zusammengesetzte Indizes sind Durchschnitte, und Durchschnitte verbergen die Form eines Modells. Hier ist dasselbe Paar in den neun einzelnen Benchmarks in unserem Snapshot.

BenchmarkClaude Opus 5Claude Fable 5
GPQA93.292.6
Die letzte Prüfung der Menschheit52.653.3
Langzeit-Kontext-Argumentation7070
SciCode55.760.2
Terminal-Bench89.184.6
Terminal-Bench Hardnicht gemessen62.9
IFBenchnicht gemessen63.5
τ-Bench Banking30.326.8
τ²-Benchnicht gemessen98.5

Opus 5 gewinnt Terminal-Bench mit 4.5 Punkten, 89.1 gegen 84.6. Es gewinnt GPQA mit 0.6, 93.2 gegen 92.6. Und es gewinnt τ-Bench Banking mit 3.5, 30.3 gegen 26.8 — bei einem Benchmark, bei dem das bessere der beiden immer noch weniger als ein Drittel einer realistischen Aufgabe eines Bankagenten richtig macht.

Fable 5 gewinnt die letzte Prüfung der Menschheit, 53.3 gegen 52.6. Und es gewinnt SciCode mit 4.5 Punkten, 60.2 gegen 55.7 — genau die Größe der Lücke, die Opus 5 auf Terminal-Bench geöffnet hat, in die andere Richtung. Bei Long Context Reasoning sind sie identisch bei 70.

Drei der neun Zeilen haben überhaupt keine Opus 5-Zahl: Terminal-Bench Hard, IFBench und τ²-Bench. Fable 5 erzielt 62.9, 63.5 und 98.5 bei ihnen. Eine fehlende Messung ist kein niedriger Wert und wir werden sie nicht so behandeln — aber wenn Ihre Arbeitslast wie Anweisungsbefolgung oder mehrstufige Werkzeugnutzung aussieht, ist Fable 5 derjenige mit veröffentlichten Beweisen und Opus 5 ist derjenige, den Sie selbst testen müssen.

Die ehrliche Zusammenfassung des direkten Vergleichs ist also: Opus 5 gewinnt die beiden Zusammensetzungen und drei der sechs Benchmarks, bei denen beide gemessen werden, Fable 5 gewinnt zwei, einer ist ein Unentschieden, und drei sind ungelöst. Das ist ein viel engeres Ergebnis als “das neuere Modell ist besser,” und es kommt immer noch zum halben Preis.

Fable 5 ist wirklich schneller — und wirklich langsamer

Geschwindigkeit sind zwei verschiedene Zahlen und sie stimmen hier nicht überein. Sobald Fable 5 generiert, generiert es schneller: 71.3 Tokens pro Sekunde gegen 62.8, ein Vorsprung von 8.5 Tokens pro Sekunde. Aber es dauert viel länger, überhaupt etwas zu sagen: 80.07 Sekunden bis zum ersten Token gegen 31.35.

Welche dieser Zahlen für Sie wichtig ist, hängt ganz davon ab, was Sie bauen. Eine Batch-Pipeline, die zehntausend Dokumente über Nacht zusammenfasst, kümmert sich um den Durchsatz und wird auf Fable 5 schneller fertig. Ein Codierungsagent, der vierzig aufeinanderfolgende Werkzeugaufrufe macht, zahlt die Kosten für das erste Token vierzigmal, und bei dieser Art von Arbeit beginnt Fable 5 48.72 Sekunden später bei jedem einzelnen, bevor ein einziges nützliches Token erscheint.

Der Aufwand-Regler bewegt sich mehr als die Modellwahl

Opus 5 bietet eine Aufwandseinstellung, und jede seiner fünf Stufen wird separat gemessen. Hier liegt die eigentliche Entscheidung, denn die Streuung innerhalb von Opus 5 ist größer als die Streuung zwischen Opus 5 und Fable 5.

EinstellungIntelligenzProgrammierungTokens / sZeit bis zum ersten Token
Opus 5, maximaler Aufwand60.778.062.831.35 s
Opus 5, sehr hoher Aufwand60.177.056.922,36 s
Opus 5, hoher Aufwand58.976.559.114,56 s
Opus 5, mittlerer Aufwand56.374.359.39,83 s
Opus 5, niedriger Aufwand50.666.959.73,01 s
Opus 4.8, maximaler Aufwand55.774.36537,44 s

Lies zuerst die Durchsatzspalte, denn sie ist die Überraschung. Sie bewegt sich kaum: 62,8, 56,9, 59,1, 59,3, 59,7. Den Aufwand zu reduzieren, lässt Opus 5 nicht schneller generieren. Was zusammenbricht, ist die Zeit bis zum ersten Token, von 31,35 Sekunden bei maximalem Aufwand auf 3,01 Sekunden bei niedrigem Aufwand.Die Aufwandseinstellung ist ein Denkzeitregler, kein Geschwindigkeitsregler.

Jetzt die Zeile, die ändern sollte, wie du die Dinge konfigurierst. Opus 5 bei mittlerem Aufwand erzielt 56,3. Opus 4.8 bei maximalem Aufwand erzielt 55,7. Das neue Modell, absichtlich auf die Mitte seines Bereichs gedrosselt, liegt 0,6 Punkte vor der vorherigen Generation, die auf Hochtouren läuft — und es beginnt, in 9,83 Sekunden zu antworten, anstatt in 37,44. Beim Codieren landen die beiden genau auf derselben Zahl, 74,3 gegen 74,3.

Claude Opus 5, Claude Fable 5 and Claude Opus 4.8: intelligence score against output price
Opus 5, Fable 5 und Opus 4.8 — zwei der drei teilen sich einen Preis.

Opus 4.8 ist identisch zu Opus 5 bepreist, mit 5 $ Eingabe und 25 $ Ausgabe. Bei diesem Paar ist das Upgrade im Listenpreis kostenlos und bringt 5 Punkte Intelligenz an der Spitze des Bereichs: 60,7 gegen 55,7. Es gibt keine Version der Arithmetik, bei der es effizient ist, bei 4.8 bei maximalem Aufwand zu bleiben.

Opus 5 schlägt Fable 5 nicht bei jeder Einstellung

Der Hauptvergleich verwendet Opus 5 bei maximalem Aufwand, und diese Darstellung schmeichelt ihm. Senke es um eine Stufe und das Ergebnis kehrt sich um.

Opus 5 bei hohem Aufwand (58,9) fällt unter die gemessenen 59,9 von Fable 5. So konfiguriert verliert das günstigere neue Modell den Gesamtscore um einen Punkt. Beim Codieren sind die beiden gleich: 76,5 und 76,5.

Die Einstellung, die den Vergleich auf beiden Achsen tatsächlich gewinnt, ist sehr hoch: 60,1 Intelligenz gegen 59,9, 77,0 Codierung gegen 76,5, erstes Token in 22,36 Sekunden gegen 80,07bei der Hälfte des angegebenen Preises. Das ist die Konfiguration, die du angeben solltest, wenn du Fable 5 in einem laufenden System ersetzt — nicht maximal, was 0,6 mehr Punkte Intelligenz für neun weitere Sekunden Latenz vor dem Start der Ausgabe kauft.

Die Aufwandstufen ändern nicht den angegebenen Preis pro Token, sodass die Rechnung davon abhängt, wie viele Tokens das Modell ausgibt, bevor es antwortet, nicht durch die Preisliste. Unser Snapshot misst diesen Aufwand indirekt, als Zeit bis zum ersten Token, und über die fünf Opus 5 Einstellungen, die von 31,35 Sekunden bis 3,01 laufen.

Was das für eine echte Rechnung bedeutet

Drei praktische Schlussfolgerungen, in der Reihenfolge, wie ein Team sie normalerweise benötigt.

Wenn du heute Fable 5 verwendest, wechsle zu Opus 5 bei sehr hohem Aufwand. Du gewinnst 0,2 Punkte Intelligenz und 0,5 beim Codieren, du reduzierst die Latenz bis zum ersten Token von 80,07 Sekunden auf 22,36, und die Preisliste halbiert sich sowohl bei Eingabe als auch Ausgabe. Das einzige, was du aufgibst, ist der nachhaltige Durchsatz, 56,9 Tokens pro Sekunde gegen 71,3, was für die Massenproduktion wichtig ist und nicht viel mehr.

Wenn du eine Einstellung anstelle eines Modells wählst, ist mittlerer Aufwand die unterschätzte Wahl. Mit 56,3 Intelligenz und 74,3 Codierung liegt es über der Obergrenze des vorherigen Flaggschiffs, und 9,83 Sekunden bis zum ersten Token liegen im Bereich, in dem ein interaktives Tool immer noch reaktionsschnell wirkt. Maximaler Aufwand existiert für die Probleme, bei denen 4,4 Punkte Index das Ergebnis wirklich entscheiden; der Großteil des Produktionsverkehrs sind nicht diese Probleme.

Wenn deine Arbeitslast das Befolgen von Anweisungen oder die Nutzung mehrerer Werkzeuge umfasst, teste es, bevor du wechselst. Fable 5 ist der einzige der beiden mit veröffentlichten Zahlen auf IFBench, Terminal-Bench Hard und τ²-Bench. Wir werden die Werte von Opus 5 dort nicht aus seinem Gesamtscore ableiten, und du solltest das auch nicht tun.

Diese Zahlen ändern sich jeden Morgen

Preise, Durchsatz und Benchmark-Indizes für 874 gemessene Modelle, täglich neu erstellt. Kostenlos, keine Anmeldung erforderlich.

Öffnen Sie den Vergleich →

Das Fazit

Ein neueres Modell, das höher bewertet wird und genau die Hälfte kostet, ist kein Preisfehler, es ist das, was passiert, wenn ein Anbieter zwei Produkte aus zwei verschiedenen Gründen 45 Tage auseinander ausliefert. Fable 5 behält einen echten Durchsatzvorteil und zwei Benchmarkgewinne. Opus 5 übernimmt die Gesamtscores, die Terminalarbeit und die Latenz.

Aber die Zahl, die du dir aus diesem Artikel merken solltest, ist nicht 60,7 gegen 59,9. Es ist 56,3 gegen 55,7, bei 9,83 Sekunden gegen 37,44 — das vorherige Flaggschiff geschlagen von einer mittleren Aufwandseinstellung beim neuen. Der Hebel mit dem größten Einfluss auf deine Rechnung ist der innerhalb des Modells, das du bereits gewählt hast.