Opus 5 contre Fable 5 — plus récent, meilleur, moitié prix
Claude Opus 5 a été expédié quarante-cinq jours après Claude Fable 5. Il obtient un score plus élevé sur les deux indices composites et coûte exactement deux fois moins par token. Cela ne devrait pas arriver, et la raison pour laquelle cela se produit est plus intéressante que le classement.
TL;DR — la version courte
Opus 5 obtient 60,7 en intelligence et 78,0 en codage pour 5 $ en entrée et 25 $ en sortie par million de tokens. Fable 5 obtient 59,9 et 76,5 pour 10 $ en entrée et 50 $ en sortie. Même fournisseur, modèle plus récent, 2× le prix pour moins de points.
Fable 5 n'est pas battu partout. Il est plus rapide en débit soutenu à 71,3 tokens par seconde contre 62,8, et il remporte l'Examen Final de l'Humanité et SciCode sans conteste.
Le paramètre compte plus que le modèle. Opus 5 avec un effort moyen obtient déjà 56,3, au-dessus d'Opus 4.8 à son effort maximum, et il commence à répondre en 9,83 secondes au lieu de 37,44. Ce réglage déplace votre latence et votre facture plus loin que le choix entre ces deux modèles.
Les deux modèles, côte à côte
Les deux chiffres ci-dessous proviennent du même instantané quotidien, lu à 05:30 le 28 juillet 2026 sur 874 modèles mesurés. Intelligence et Codage sont des indices composites d'Artificial Analysis ; le débit, le temps jusqu'au premier token et le prix sont suivis en parallèle.
| Métrique | Claude Opus 5 | Claude Fable 5 |
|---|---|---|
| Publié | 24 juillet 2026 | 9 juin 2026 |
| Intelligence | 60.7 | 59.9 |
| Codage | 78.0 | 76.5 |
| $ / 1M entrée | $5 | $10 |
| $ / 1M sortie | $25 | $50 |
| Tokens / s | 62.8 | 71.3 |
| Temps jusqu'au premier token | 31,35 s | 80,07 s |
La ligne de prix mérite d'être lue deux fois. Ce n'est pas à peu près la moitié, c'est exactement la moitié : 5 $ contre 10 $ en entrée, 25 $ contre 50 $ en sortie. Rien dans les deux colonnes de score ne justifie ce ratio — l'écart est 0,8 points d'intelligence et 1,5 points de codage, tous deux en faveur du modèle moins cher.
Une mise en garde avant les benchmarks : les deux modèles fonctionnent avec une configuration de raisonnement adaptatif, donc aucun n'est un modèle à passage unique simple. La colonne Opus 5 est son réglage à effort maximum, l'un des cinq que nous suivons ; Fable 5 a une seule configuration mesurée, qui obtient 59,9. Ce dernier point devient tout l'argument plus bas.
La répartition des benchmarks n'est pas unilatérale
Les indices composites sont des moyennes, et les moyennes cachent la forme d'un modèle. Voici la même paire sur les neuf benchmarks individuels dans notre instantané.
| Benchmark | Claude Opus 5 | Claude Fable 5 |
|---|---|---|
| GPQA | 93.2 | 92.6 |
| Examen Final de l'Humanité | 52.6 | 53.3 |
| Raisonnement sur de longs contextes | 70 | 70 |
| SciCode | 55.7 | 60.2 |
| Terminal-Bench | 89.1 | 84.6 |
| Terminal-Bench Hard | non mesuré | 62.9 |
| IFBench | non mesuré | 63.5 |
| τ-Bench Banking | 30.3 | 26.8 |
| τ²-Bench | non mesuré | 98.5 |
Opus 5 prend Terminal-Bench par 4,5 points, 89,1 contre 84,6. Il prend GPQA par 0,6, 93,2 contre 92,6. Et il prend τ-Bench Banking par 3,5, 30,3 contre 26,8 — sur un benchmark où le meilleur des deux obtient encore moins d'un tiers d'une tâche réaliste d'agent bancaire.
Fable 5 prend l'Examen Final de l'Humanité, 53,3 contre 52,6. Et il prend SciCode par 4,5 points, 60,2 contre 55,7 — la taille exacte de l'écart qu'Opus 5 a ouvert sur Terminal-Bench, dans l'autre direction. Sur le Raisonnement à Long Terme, ils sont identiques à 70.
Donc, le résumé honnête du face-à-face est : Opus 5 gagne les deux composites et trois des six benchmarks où les deux sont mesurés, Fable 5 en gagne deux, un est un match nul, et trois sont non résolus. C'est un résultat beaucoup plus étroit que “le modèle plus récent est meilleur,” et cela reste à moitié prix.
Fable 5 est vraiment plus rapide — et vraiment plus lent
La vitesse est deux chiffres différents et ils ne s'accordent pas ici. Une fois que Fable 5 génère, il génère plus vite : 71,3 tokens par seconde contre 62,8, un avantage de 8,5 tokens par seconde. Mais il faut beaucoup plus de temps pour dire quoi que ce soit : 80,07 secondes jusqu'au premier jeton contre 31,35.
Ce qui vous importe dépend entièrement de ce que vous construisez. Un pipeline par lot qui résume dix mille documents pendant la nuit se soucie du débit et finira plus tôt sur Fable 5. Un agent de codage qui effectue quarante appels d'outils séquentiels paie le coût du premier jeton quarante fois, et sur ce type de travail, Fable 5 commence 48,72 secondes plus tard sur chacun d'eux, avant qu'un seul jeton de sortie utile n'apparaisse.
Le cadran d'effort bouge plus que le choix du modèle
Opus 5 expose un réglage d'effort, et chacun de ses cinq niveaux est mesuré séparément. C'est là que se trouve la véritable décision, car l'écart à l'intérieur d'Opus 5 est plus grand que l'écart entre Opus 5 et Fable 5.
| Réglage | Intelligence | Codage | Tokens / s | Temps jusqu'au premier token |
|---|---|---|---|---|
| Opus 5, effort max | 60.7 | 78.0 | 62.8 | 31,35 s |
| Opus 5, effort xhigh | 60.1 | 77.0 | 56.9 | 22,36 s |
| Opus 5, effort élevé | 58.9 | 76.5 | 59.1 | 14,56 s |
| Opus 5, effort moyen | 56.3 | 74.3 | 59.3 | 9,83 s |
| Opus 5, effort faible | 50.6 | 66.9 | 59.7 | 3,01 s |
| Opus 4.8, effort max | 55.7 | 74.3 | 65 | 37,44 s |
Lisez d'abord la colonne de débit, car c'est la surprise. Elle bouge à peine : 62,8, 56,9, 59,1, 59,3, 59,7. Réduire l'effort ne fait pas générer Opus 5 plus rapidement. Ce qui s'effondre, c'est le temps jusqu'au premier jeton, de 31,35 secondes au maximum à 3,01 secondes au minimum.Le réglage d'effort est un cadran de temps de réflexion, pas un cadran de vitesse.
Maintenant, la ligne qui devrait changer la façon dont vous configurez les choses. Opus 5 à effort moyen obtient 56,3. Opus 4.8 à son effort maximum obtient 55,7. Le nouveau modèle, délibérément limité au milieu de sa plage, est 0,6 points devant la génération précédente fonctionnant à plein régime — et il commence à répondre en 9,83 secondes au lieu de 37,44. En codage, les deux atteignent exactement le même chiffre, 74,3 contre 74,3.
Opus 4.8 est tarifé identiquement à Opus 5, à 5 $ en entrée et 25 $ en sortie. Donc, sur cette paire, la mise à niveau est gratuite en prix de liste et vaut 5 points d'intelligence au sommet de la gamme : 60,7 contre 55,7. Il n'y a aucune version de l'arithmétique où rester sur 4.8 à effort maximum est le choix efficace.
Opus 5 ne bat pas Fable 5 à tous les réglages
La comparaison principale utilise Opus 5 à effort maximum, et ce cadre le flatte. Réduisez-le d'un cran et le résultat s'inverse.
Opus 5 à effort élevé (58,9) tombe en dessous du 59,9 mesuré de Fable 5. Configuré de cette manière, le modèle plus récent et moins cher perd le composite d'un point. En codage, les deux sont à égalité : 76,5 et 76,5.
Le réglage qui gagne réellement la comparaison sur les deux axes est xhigh : 60,1 intelligence contre 59,9, 77,0 codage contre 76,5, premier jeton en 22,36 secondes contre 80,07, à moitié du prix affiché. C'est la configuration à citer si vous remplacez Fable 5 dans un système en cours d'exécution — pas max, qui achète 0,6 points d'intelligence supplémentaires pour neuf secondes de latence avant que la sortie ne commence.
Les niveaux d'effort ne changent pas le prix affiché par jeton, donc la facture dépend du nombre de jetons que le modèle dépense avant de répondre, et non du tarif. Notre instantané mesure cette dépense indirectement, comme le temps jusqu'au premier jeton, et à travers les cinq réglages d'Opus 5 qui vont de 31,35 secondes à 3,01.
Ce que cela signifie pour une facture réelle
Trois conclusions pratiques, dans l'ordre dont une équipe a généralement besoin.
Si vous êtes sur Fable 5 aujourd'hui, passez à Opus 5 à effort xhigh. Vous gagnez 0,2 points d'intelligence et 0,5 en codage, vous réduisez la latence du premier jeton de 80,07 secondes à 22,36, et le tarif est réduit de moitié sur les entrées et les sorties. La seule chose que vous abandonnez est le débit soutenu, 56,9 jetons par seconde contre 71,3, ce qui compte pour la génération en masse et pas grand-chose d'autre.
Si vous choisissez un réglage plutôt qu'un modèle, le moyen est celui qui est sous-estimé. Avec 56,3 d'intelligence et 74,3 de codage, il est au-dessus du plafond du précédent modèle phare, et 9,83 secondes jusqu'au premier jeton est dans la plage où un outil interactif semble encore réactif. L'effort maximum existe pour les problèmes où 4,4 points d'index décident réellement du résultat ; la plupart du trafic de production ne concerne pas ces problèmes.
Si votre charge de travail consiste à suivre des instructions ou à utiliser des outils en plusieurs tours, évaluez-la avant de changer. Fable 5 est le seul des deux avec des chiffres publiés sur IFBench, Terminal-Bench Hard et τ²-Bench. Nous n'allons pas déduire les scores d'Opus 5 à partir de son composite, et vous ne devriez pas non plus.
Ces chiffres changent chaque matin
Prix, débit et indices de benchmark pour 874 modèles mesurés, reconstruits quotidiennement. Gratuit, sans inscription.
Ouvrez le comparateur →Le constat
Un modèle plus récent qui obtient un score plus élevé et coûte exactement deux fois moins cher n'est pas une erreur de prix, c'est ce qui se passe lorsqu'un fournisseur expédie deux produits pour deux raisons différentes avec quarante-cinq jours d'écart. Fable 5 conserve un véritable avantage en débit et deux victoires au benchmark. Opus 5 prend les composites, le travail terminal et la latence.
Mais le chiffre à retenir de cet article n'est pas 60.7 contre 59.9. C'est 56.3 contre 55.7, à 9.83 secondes contre 37.44 — le précédent fleuron battu par un réglage moyen sur le nouveau. Le levier ayant le plus d'impact sur votre facture est celui à l'intérieur du modèle que vous avez déjà choisi.