Outils IA Projets Annuaire
🏆 Classement 📡 Actualités ✨ Invites ⚖️ Comparer les Modèles 🔧 Outils 📦 Projets 🚀 Espaces
Blog
Comparaison de modèles

Opus 5 contre Fable 5 — plus récent, meilleur, moitié prix

Claude Opus 5 a été expédié quarante-cinq jours après Claude Fable 5. Il obtient un score plus élevé sur les deux indices composites et coûte exactement deux fois moins par token. Cela ne devrait pas arriver, et la raison pour laquelle cela se produit est plus intéressante que le classement.

Mis à jour le 28 juillet 2026·9 min de lecture·Pas de mur payant

TL;DR — la version courte

Opus 5 obtient 60,7 en intelligence et 78,0 en codage pour 5 $ en entrée et 25 $ en sortie par million de tokens. Fable 5 obtient 59,9 et 76,5 pour 10 $ en entrée et 50 $ en sortie. Même fournisseur, modèle plus récent, 2× le prix pour moins de points.

Fable 5 n'est pas battu partout. Il est plus rapide en débit soutenu à 71,3 tokens par seconde contre 62,8, et il remporte l'Examen Final de l'Humanité et SciCode sans conteste.

Le paramètre compte plus que le modèle. Opus 5 avec un effort moyen obtient déjà 56,3, au-dessus d'Opus 4.8 à son effort maximum, et il commence à répondre en 9,83 secondes au lieu de 37,44. Ce réglage déplace votre latence et votre facture plus loin que le choix entre ces deux modèles.

Les deux modèles, côte à côte

Les deux chiffres ci-dessous proviennent du même instantané quotidien, lu à 05:30 le 28 juillet 2026 sur 874 modèles mesurés. Intelligence et Codage sont des indices composites d'Artificial Analysis ; le débit, le temps jusqu'au premier token et le prix sont suivis en parallèle.

MétriqueClaude Opus 5Claude Fable 5
Publié24 juillet 20269 juin 2026
Intelligence60.759.9
Codage78.076.5
$ / 1M entrée$5$10
$ / 1M sortie$25$50
Tokens / s62.871.3
Temps jusqu'au premier token31,35 s80,07 s

La ligne de prix mérite d'être lue deux fois. Ce n'est pas à peu près la moitié, c'est exactement la moitié : 5 $ contre 10 $ en entrée, 25 $ contre 50 $ en sortie. Rien dans les deux colonnes de score ne justifie ce ratio — l'écart est 0,8 points d'intelligence et 1,5 points de codage, tous deux en faveur du modèle moins cher.

Claude Opus 5 versus Claude Fable 5: intelligence score and output price per million tokens
Deux modèles du même fournisseur, à quarante-cinq jours d'intervalle. Redessiné quotidiennement à partir des prix en direct.

Une mise en garde avant les benchmarks : les deux modèles fonctionnent avec une configuration de raisonnement adaptatif, donc aucun n'est un modèle à passage unique simple. La colonne Opus 5 est son réglage à effort maximum, l'un des cinq que nous suivons ; Fable 5 a une seule configuration mesurée, qui obtient 59,9. Ce dernier point devient tout l'argument plus bas.

La répartition des benchmarks n'est pas unilatérale

Les indices composites sont des moyennes, et les moyennes cachent la forme d'un modèle. Voici la même paire sur les neuf benchmarks individuels dans notre instantané.

BenchmarkClaude Opus 5Claude Fable 5
GPQA93.292.6
Examen Final de l'Humanité52.653.3
Raisonnement sur de longs contextes7070
SciCode55.760.2
Terminal-Bench89.184.6
Terminal-Bench Hardnon mesuré62.9
IFBenchnon mesuré63.5
τ-Bench Banking30.326.8
τ²-Benchnon mesuré98.5

Opus 5 prend Terminal-Bench par 4,5 points, 89,1 contre 84,6. Il prend GPQA par 0,6, 93,2 contre 92,6. Et il prend τ-Bench Banking par 3,5, 30,3 contre 26,8 — sur un benchmark où le meilleur des deux obtient encore moins d'un tiers d'une tâche réaliste d'agent bancaire.

Fable 5 prend l'Examen Final de l'Humanité, 53,3 contre 52,6. Et il prend SciCode par 4,5 points, 60,2 contre 55,7 — la taille exacte de l'écart qu'Opus 5 a ouvert sur Terminal-Bench, dans l'autre direction. Sur le Raisonnement à Long Terme, ils sont identiques à 70.

Trois des neuf lignes n'ont pas de numéro Opus 5 du tout : Terminal-Bench Hard, IFBench et τ²-Bench. Fable 5 affiche 62,9, 63,5 et 98,5 sur ces benchmarks. Une mesure manquante n'est pas un score bas et nous ne la traiterons pas comme telle — mais si votre charge de travail ressemble à du suivi d'instructions ou à l'utilisation d'outils multi-tours, Fable 5 est celui avec des preuves publiées et Opus 5 est celui que vous devez tester vous-même.

Donc, le résumé honnête du face-à-face est : Opus 5 gagne les deux composites et trois des six benchmarks où les deux sont mesurés, Fable 5 en gagne deux, un est un match nul, et trois sont non résolus. C'est un résultat beaucoup plus étroit que “le modèle plus récent est meilleur,” et cela reste à moitié prix.

Fable 5 est vraiment plus rapide — et vraiment plus lent

La vitesse est deux chiffres différents et ils ne s'accordent pas ici. Une fois que Fable 5 génère, il génère plus vite : 71,3 tokens par seconde contre 62,8, un avantage de 8,5 tokens par seconde. Mais il faut beaucoup plus de temps pour dire quoi que ce soit : 80,07 secondes jusqu'au premier jeton contre 31,35.

Ce qui vous importe dépend entièrement de ce que vous construisez. Un pipeline par lot qui résume dix mille documents pendant la nuit se soucie du débit et finira plus tôt sur Fable 5. Un agent de codage qui effectue quarante appels d'outils séquentiels paie le coût du premier jeton quarante fois, et sur ce type de travail, Fable 5 commence 48,72 secondes plus tard sur chacun d'eux, avant qu'un seul jeton de sortie utile n'apparaisse.

Le cadran d'effort bouge plus que le choix du modèle

Opus 5 expose un réglage d'effort, et chacun de ses cinq niveaux est mesuré séparément. C'est là que se trouve la véritable décision, car l'écart à l'intérieur d'Opus 5 est plus grand que l'écart entre Opus 5 et Fable 5.

RéglageIntelligenceCodageTokens / sTemps jusqu'au premier token
Opus 5, effort max60.778.062.831,35 s
Opus 5, effort xhigh60.177.056.922,36 s
Opus 5, effort élevé58.976.559.114,56 s
Opus 5, effort moyen56.374.359.39,83 s
Opus 5, effort faible50.666.959.73,01 s
Opus 4.8, effort max55.774.36537,44 s

Lisez d'abord la colonne de débit, car c'est la surprise. Elle bouge à peine : 62,8, 56,9, 59,1, 59,3, 59,7. Réduire l'effort ne fait pas générer Opus 5 plus rapidement. Ce qui s'effondre, c'est le temps jusqu'au premier jeton, de 31,35 secondes au maximum à 3,01 secondes au minimum.Le réglage d'effort est un cadran de temps de réflexion, pas un cadran de vitesse.

Maintenant, la ligne qui devrait changer la façon dont vous configurez les choses. Opus 5 à effort moyen obtient 56,3. Opus 4.8 à son effort maximum obtient 55,7. Le nouveau modèle, délibérément limité au milieu de sa plage, est 0,6 points devant la génération précédente fonctionnant à plein régime — et il commence à répondre en 9,83 secondes au lieu de 37,44. En codage, les deux atteignent exactement le même chiffre, 74,3 contre 74,3.

Claude Opus 5, Claude Fable 5 and Claude Opus 4.8: intelligence score against output price
Opus 5, Fable 5 et Opus 4.8 — deux des trois partagent un prix.

Opus 4.8 est tarifé identiquement à Opus 5, à 5 $ en entrée et 25 $ en sortie. Donc, sur cette paire, la mise à niveau est gratuite en prix de liste et vaut 5 points d'intelligence au sommet de la gamme : 60,7 contre 55,7. Il n'y a aucune version de l'arithmétique où rester sur 4.8 à effort maximum est le choix efficace.

Opus 5 ne bat pas Fable 5 à tous les réglages

La comparaison principale utilise Opus 5 à effort maximum, et ce cadre le flatte. Réduisez-le d'un cran et le résultat s'inverse.

Opus 5 à effort élevé (58,9) tombe en dessous du 59,9 mesuré de Fable 5. Configuré de cette manière, le modèle plus récent et moins cher perd le composite d'un point. En codage, les deux sont à égalité : 76,5 et 76,5.

Le réglage qui gagne réellement la comparaison sur les deux axes est xhigh : 60,1 intelligence contre 59,9, 77,0 codage contre 76,5, premier jeton en 22,36 secondes contre 80,07, à moitié du prix affiché. C'est la configuration à citer si vous remplacez Fable 5 dans un système en cours d'exécution — pas max, qui achète 0,6 points d'intelligence supplémentaires pour neuf secondes de latence avant que la sortie ne commence.

Les niveaux d'effort ne changent pas le prix affiché par jeton, donc la facture dépend du nombre de jetons que le modèle dépense avant de répondre, et non du tarif. Notre instantané mesure cette dépense indirectement, comme le temps jusqu'au premier jeton, et à travers les cinq réglages d'Opus 5 qui vont de 31,35 secondes à 3,01.

Ce que cela signifie pour une facture réelle

Trois conclusions pratiques, dans l'ordre dont une équipe a généralement besoin.

Si vous êtes sur Fable 5 aujourd'hui, passez à Opus 5 à effort xhigh. Vous gagnez 0,2 points d'intelligence et 0,5 en codage, vous réduisez la latence du premier jeton de 80,07 secondes à 22,36, et le tarif est réduit de moitié sur les entrées et les sorties. La seule chose que vous abandonnez est le débit soutenu, 56,9 jetons par seconde contre 71,3, ce qui compte pour la génération en masse et pas grand-chose d'autre.

Si vous choisissez un réglage plutôt qu'un modèle, le moyen est celui qui est sous-estimé. Avec 56,3 d'intelligence et 74,3 de codage, il est au-dessus du plafond du précédent modèle phare, et 9,83 secondes jusqu'au premier jeton est dans la plage où un outil interactif semble encore réactif. L'effort maximum existe pour les problèmes où 4,4 points d'index décident réellement du résultat ; la plupart du trafic de production ne concerne pas ces problèmes.

Si votre charge de travail consiste à suivre des instructions ou à utiliser des outils en plusieurs tours, évaluez-la avant de changer. Fable 5 est le seul des deux avec des chiffres publiés sur IFBench, Terminal-Bench Hard et τ²-Bench. Nous n'allons pas déduire les scores d'Opus 5 à partir de son composite, et vous ne devriez pas non plus.

Ces chiffres changent chaque matin

Prix, débit et indices de benchmark pour 874 modèles mesurés, reconstruits quotidiennement. Gratuit, sans inscription.

Ouvrez le comparateur →

Le constat

Un modèle plus récent qui obtient un score plus élevé et coûte exactement deux fois moins cher n'est pas une erreur de prix, c'est ce qui se passe lorsqu'un fournisseur expédie deux produits pour deux raisons différentes avec quarante-cinq jours d'écart. Fable 5 conserve un véritable avantage en débit et deux victoires au benchmark. Opus 5 prend les composites, le travail terminal et la latence.

Mais le chiffre à retenir de cet article n'est pas 60.7 contre 59.9. C'est 56.3 contre 55.7, à 9.83 secondes contre 37.44 — le précédent fleuron battu par un réglage moyen sur le nouveau. Le levier ayant le plus d'impact sur votre facture est celui à l'intérieur du modèle que vous avez déjà choisi.