Opus 5 gegen Fable 5 — neuer, besser, halb so teuer
Claude Opus 5 wurde fünfundvierzig Tage nach Claude Fable 5 veröffentlicht. Es erzielt höhere Werte in beiden zusammengesetzten Indizes und kostet genau die Hälfte pro Token. Das sollte nicht passieren, und der Grund dafür ist interessanter als das Ranking.
TL;DR — die kurze Version
Opus 5 erzielt 60,7 in Intelligenz und 78,0 in Programmierung für $5 Eingabe und $25 Ausgabe pro Million Tokens. Fable 5 erzielt 59,9 und 76,5 für $10 Eingabe und $50 Ausgabe. Gleicher Anbieter, neueres Modell, 2× der Preis für weniger Punkte.
Fable 5 wird nicht überall geschlagen. Es ist schneller im kontinuierlichen Durchsatz mit 71,3 Tokens pro Sekunde gegenüber 62,8, und es gewinnt den Humanity’s Last Exam und SciCode eindeutig.
Die Einstellung ist wichtiger als das Modell. Opus 5 erzielt bei mittlerem Aufwand bereits 56,3, über Opus 4.8 bei maximalem Aufwand, und es beginnt, in 9,83 Sekunden zu antworten, anstatt in 37,44. Dieser Regler beeinflusst Ihre Latenz und Ihre Rechnung mehr als die Wahl zwischen diesen beiden Modellen.
Die beiden Modelle, nebeneinander
Beide Zahlen unten stammen aus demselben täglichen Snapshot, gelesen um 05:30 am 28. Juli 2026 über 874 gemessene Modelle. Intelligenz und Programmierung sind zusammengesetzte Indizes von Artificial Analysis; Durchsatz, Zeit bis zum ersten Token und Preis verfolgen wir parallel dazu. Preise sind Dollar pro Million Tokens.
| Metrik | Claude Opus 5 | Claude Fable 5 |
|---|---|---|
| Veröffentlicht | 24. Juli 2026 | 9. Juni 2026 |
| Intelligenz | 60.7 | 59.9 |
| Programmierung | 78.0 | 76.5 |
| $ / 1M Eingabe | $5 | $10 |
| $ / 1M Ausgabe | $25 | $50 |
| Tokens / s | 62.8 | 71.3 |
| Zeit bis zum ersten Token | 31,35 s | 80,07 s |
Die Preiskurve ist es wert, zweimal gelesen zu werden. Es ist nicht grob die Hälfte, es ist genau die Hälfte: $5 gegen $10 bei der Eingabe, $25 gegen $50 bei der Ausgabe. Nichts in den beiden Punktzahlen rechtfertigt dieses Verhältnis — die Lücke beträgt 0,8 Punkte in Intelligenz und 1,5 Punkte in Programmierung, beide zugunsten des günstigeren Modells.
Ein Vorbehalt vor den Benchmarks: Beide Modelle laufen mit einer adaptiven Denkweise, daher ist keines ein einfaches Ein-Pass-Modell. Die Opus 5-Spalte ist ihre maximale Einstellung, eine von fünf, die wir verfolgen; Fable 5 hat eine einzige gemessene Konfiguration, die 59,9 erzielt. Dieser letzte Punkt wird weiter unten zum gesamten Argument.
Die Benchmark-Trennung ist nicht einseitig
Zusammengesetzte Indizes sind Durchschnitte, und Durchschnitte verbergen die Form eines Modells. Hier ist dasselbe Paar bei den neun einzelnen Benchmarks in unserem Snapshot.
| Benchmark | Claude Opus 5 | Claude Fable 5 |
|---|---|---|
| GPQA | 93.2 | 92.6 |
| Humanity’s Last Exam | 52.6 | 53.3 |
| Langzeit-Kontext-Argumentation | 70 | 70 |
| SciCode | 55.7 | 60.2 |
| Terminal-Bench | 89.1 | 84.6 |
| Terminal-Bench Hard | nicht gemessen | 62.9 |
| IFBench | nicht gemessen | 63.5 |
| τ-Bench Banking | 30.3 | 26.8 |
| τ²-Bench | nicht gemessen | 98.5 |
Opus 5 gewinnt Terminal-Bench mit 4,5 Punkten, 89,1 gegen 84,6. Es gewinnt GPQA mit 0,6, 93,2 gegen 92,6. Und es gewinnt τ-Bench Banking mit 3,5, 30,3 gegen 26,8 — bei einem Benchmark, bei dem der bessere der beiden immer noch weniger als ein Drittel einer realistischen Bankagentenaufgabe richtig macht.
Fable 5 gewinnt Humanity’s Last Exam, 53,3 gegen 52,6. Und es gewinnt SciCode mit 4,5 Punkten, 60,2 gegen 55,7 — genau die Größe der Lücke, die Opus 5 bei Terminal-Bench geöffnet hat, in die andere Richtung. Bei Long Context Reasoning sind sie identisch bei 70.
Die ehrliche Zusammenfassung des direkten Vergleichs ist also: Opus 5 gewinnt die beiden Zusammensetzungen und drei der sechs Benchmarks, bei denen beide gemessen werden, Fable 5 gewinnt zwei, einer ist ein Unentschieden, und drei sind ungelöst. Das ist ein viel engeres Ergebnis als “das neuere Modell ist besser,” und es kommt immer noch zum halben Preis.
Fable 5 ist wirklich schneller — und wirklich langsamer
Geschwindigkeit sind zwei verschiedene Zahlen und sie stimmen hier nicht überein. Sobald Fable 5 generiert, generiert es schneller: 71,3 Tokens pro Sekunde gegen 62,8, ein Vorsprung von 8,5 Tokens pro Sekunde. Aber es dauert viel länger, überhaupt etwas zu sagen: 80,07 Sekunden bis zum ersten Token gegenüber 31,35.
Welche dieser Werte für Sie wichtig sind, hängt ganz davon ab, was Sie bauen. Eine Batch-Pipeline, die zehntausend Dokumente über Nacht zusammenfasst, kümmert sich um den Durchsatz und wird auf Fable 5 schneller fertig. Ein Coding-Agent, der vierzig aufeinanderfolgende Toolaufrufe macht, zahlt die Kosten für das erste Token vierzigmal, und bei dieser Art von Arbeit beginnt Fable 5 48,72 Sekunden später bei jedem einzelnen, bevor ein einziges nützliches Token erscheint.
Der Aufwand-Regler bewegt sich mehr als die Modellwahl
Opus 5 bietet eine Aufwandseinstellung, und jede seiner fünf Stufen wird separat gemessen. Hier liegt die eigentliche Entscheidung, denn die Spannweite innerhalb von Opus 5 ist größer als die Spannweite zwischen Opus 5 und Fable 5.
| Einstellung | Intelligenz | Programmierung | Tokens / s | Zeit bis zum ersten Token |
|---|---|---|---|---|
| Opus 5, maximaler Aufwand | 60.7 | 78.0 | 62.8 | 31,35 s |
| Opus 5, sehr hoher Aufwand | 60.1 | 77.0 | 56.9 | 22,36 s |
| Opus 5, hoher Aufwand | 58.9 | 76.5 | 59.1 | 14,56 s |
| Opus 5, mittlerer Aufwand | 56.3 | 74.3 | 59.3 | 9,83 s |
| Opus 5, niedriger Aufwand | 50.6 | 66.9 | 59.7 | 3,01 s |
| Opus 4.8, maximaler Aufwand | 55.7 | 74.3 | 65 | 37,44 s |
Lesen Sie zuerst die Durchsatzspalte, denn sie ist die Überraschung. Sie bewegt sich kaum: 62,8, 56,9, 59,1, 59,3, 59,7. Den Aufwand zu reduzieren, lässt Opus 5 nicht schneller generieren. Was zusammenbricht, ist die Zeit bis zum ersten Token, von 31,35 Sekunden bei maximalem Aufwand auf 3,01 Sekunden bei niedrigem Aufwand.Die Aufwandseinstellung ist ein Denkzeit-Regler, kein Geschwindigkeitsregler.
Jetzt die Zeile, die ändern sollte, wie Sie die Dinge konfigurieren. Opus 5 bei mittlerem Aufwand erzielt 56,3. Opus 4.8 bei maximalem Aufwand erzielt 55,7. Das neue Modell, absichtlich auf die Mitte seines Bereichs gedrosselt, liegt 0,6 Punkte vor der vorherigen Generation, die auf Hochtouren läuft — und es beginnt, in 9,83 Sekunden zu antworten, anstatt in 37,44. Beim Codieren landen die beiden genau bei derselben Zahl, 74,3 gegenüber 74,3.
Opus 4.8 ist identisch zu Opus 5 bepreist, bei 5 $ Eingabe und 25 $ Ausgabe. Bei diesem Paar ist das Upgrade im Listenpreis kostenlos und bringt 5 Punkte Intelligenz an der Spitze des Bereichs: 60,7 gegenüber 55,7. Es gibt keine Version der Arithmetik, bei der es effizient ist, bei 4.8 bei maximalem Aufwand zu bleiben.
Opus 5 schlägt Fable 5 nicht bei jeder Einstellung
Der Hauptvergleich verwendet Opus 5 bei maximalem Aufwand, und diese Darstellung schmeichelt ihm. Senken Sie es um eine Stufe und das Ergebnis kehrt sich um.
Opus 5 bei hohem Aufwand (58,9) fällt unter die gemessenen 59,9 von Fable 5. So konfiguriert verliert das günstigere, neuere Modell den Vergleich um einen Punkt. Beim Codieren sind die beiden gleich: 76,5 und 76,5.
Die Einstellung, die den Vergleich auf beiden Achsen tatsächlich gewinnt, ist xhigh: 60,1 Intelligenz gegenüber 59,9, 77,0 Codierung gegenüber 76,5, erstes Token in 22,36 Sekunden gegenüber 80,07, zum halben angegebenen Preis. Das ist die Konfiguration, die Sie angeben sollten, wenn Sie Fable 5 in einem laufenden System ersetzen — nicht maximal, was 0,6 mehr Punkte Intelligenz für neun weitere Sekunden Latenz vor dem Start der Ausgabe kauft.
Die Aufwandstufen ändern nicht den angegebenen Preis pro Token, sodass die Rechnung davon abhängt, wie viele Tokens das Modell ausgibt, bevor es antwortet, nicht durch die Preisliste. Unser Snapshot misst diese Ausgaben indirekt, als Zeit bis zum ersten Token, und über die fünf Opus 5-Einstellungen, die von 31,35 Sekunden bis 3,01 reichen.
Was das für eine echte Rechnung bedeutet
Drei praktische Schlussfolgerungen, in der Reihenfolge, wie ein Team sie normalerweise benötigt.
Wenn Sie heute Fable 5 verwenden, wechseln Sie zu Opus 5 bei sehr hohem Aufwand. Sie gewinnen 0,2 Punkte Intelligenz und 0,5 beim Codieren, Sie reduzieren die Latenz bis zum ersten Token von 80,07 Sekunden auf 22,36, und die Preisliste halbiert sich sowohl bei Eingabe als auch bei Ausgabe. Das einzige, was Sie aufgeben, ist der nachhaltige Durchsatz, 56,9 Tokens pro Sekunde gegenüber 71,3, was für die Massenproduktion wichtig ist und nicht viel anderes.
Wenn Sie eine Einstellung anstelle eines Modells wählen, ist mittel die unterschätzte. Mit 56,3 Intelligenz und 74,3 Codierung liegt es über der Obergrenze des vorherigen Flaggschiffs, und 9,83 Sekunden bis zum ersten Token liegen im Bereich, in dem ein interaktives Tool immer noch reaktionsschnell erscheint. Maximaler Aufwand existiert für die Probleme, bei denen 4,4 Punkte Index tatsächlich das Ergebnis entscheiden; der Großteil des Produktionsverkehrs sind nicht diese Probleme.
Wenn Ihre Arbeitslast das Befolgen von Anweisungen oder die Nutzung mehrerer Tools umfasst, benchmarken Sie es, bevor Sie wechseln. Fable 5 ist das einzige der beiden Modelle mit veröffentlichten Zahlen auf IFBench, Terminal-Bench Hard und τ²-Bench. Wir werden die Werte von Opus 5 dort nicht aus seinem Komposit ableiten, und das solltest du auch nicht.
Diese Zahlen ändern sich jeden Morgen
Preise, Durchsatz und Benchmark-Indizes für 874 gemessene Modelle, täglich neu erstellt. Kostenlos, keine Anmeldung erforderlich.
Öffne den Vergleich →Das Fazit
Ein neueres Modell, das höher punktet und genau die Hälfte kostet, ist kein Preisfehler, sondern das Ergebnis, wenn ein Anbieter zwei Produkte aus zwei verschiedenen Gründen 45 Tage auseinander ausliefert. Fable 5 hat einen echten Durchsatzvorteil und zwei Benchmark-Siege. Opus 5 übernimmt die Komposits, die Terminalarbeit und die Latenz.
Aber die Zahl, die du dir aus diesem Artikel merken solltest, ist nicht 60.7 gegen 59.9. Es ist 56.3 gegen 55.7, bei 9.83 Sekunden gegen 37.44 — das vorherige Flaggschiff wurde von einer mittleren Einstellung des neuen Modells geschlagen. Der Hebel mit dem größten Einfluss auf deine Rechnung ist der innerhalb des Modells, das du bereits gewählt hast.