Skip to main content
Claude AI

Claude Sonnet 5 vs Opus 4.8 : Quand Utiliser Lequel

Claude Sonnet 5 vs Opus 4.8 : benchmarks décryptés, vrai calcul des prix et le piège du niveau d'effort qui peut rendre Sonnet plus cher qu'Opus.

18 min
Temps de lecture
3,578
Mots
Publié
Dernière révision
Engr Mejba Ahmed

Écrit par

Engr Mejba Ahmed

Partager l'article

Claude Sonnet 5 vs Opus 4.8 : Quand Utiliser Lequel
Claude Sonnet 5 vs Opus 4.8 : Quand Utiliser Lequel - Video thumbnail

Pendant environ un an, ma logique de choix de modèle était paresseuse, et elle fonctionnait : si la tâche comptait, je prenais Opus. Sinon, je prenais Sonnet et j'acceptais que le résultat serait un cran en dessous. Deux paliers, deux prix, un raccourci mental bien net.

Claude Sonnet 5 a cassé ce raccourci le 30 juin 2026, et j'y adapte encore mes réflexes.

Voici la version courte, parce que vous avez cherché Claude Sonnet 5 vs Opus 4.8 et que vous méritez la réponse avant de scroller : Sonnet 5 se situe à quelques points d'Opus 4.8 sur la plupart des benchmarks, le bat en fait sur le travail intellectuel, et coûte 40 % du prix par token d'entrée. Mais il y a un réglage enfoui dans l'API — le niveau d'effort — qui peut discrètement faire basculer Sonnet 5 d'« affaire incroyable » à « plus cher qu'Opus pour le même résultat ». Toute la décision se joue dans ce détail, et presque personne n'en parle.

Alors parlons-en. Pas le communiqué de presse. Le vrai calcul, le piège, et la règle que j'utilise désormais pour choisir entre les deux, tâche par tâche.

Où Sonnet 5 s'inscrit dans la gamme Claude

Sonnet 5 est le nouveau modèle de milieu de gamme dans la famille Claude — le créneau entre les modèles d'entrée de gamme et les poids lourds Opus et Fable/Mythos. Sur le papier, c'est « juste » une mise à jour de Sonnet. Dans la pratique, le saut depuis Sonnet 4.6 est le plus gros gain intergénération que j'aie vu dans ce palier, et l'écart avec Opus 4.8 s'est rétréci au point de devenir vraiment embarrassant pour la propre grille tarifaire d'Anthropic.

Il est devenu, dès le jour du lancement, le modèle par défaut pour les plans Free et Pro, et il est disponible pour Max, Team, Enterprise, ainsi que via l'API. Si vous avez utilisé Claude sur le web depuis fin juin sans rien modifier, vous avez probablement déjà discuté avec Sonnet 5 sans le savoir.

L'angle que tout le monde a retenu — TechCrunch, VentureBeat, The New Stack — était une variante de « une façon moins chère de faire tourner des agents ». C'est vrai, mais ça sous-estime le changement structurel. Pour la première fois, Sonnet et Opus se placent sur une seule et même courbe coût-performance au lieu de deux paliers séparés. L'ancienne division « bon modèle / excellent modèle » devient « même famille de modèles, choisissez votre point sur la courbe ». Ça change la façon d'architecturer tout ce qui fait plus d'une poignée d'appels au modèle.

Avant d'en venir à la courbe, regardons où les chiffres atterrissent réellement. C'est la partie que le marketing survole.

Le tableau des benchmarks, lu honnêtement

Voici la comparaison propre à Anthropic, et je veux la lire comme je la lirais avant de miser un projet dessus — colonne par colonne, pas comme une bande-annonce.

Codage agentique, SWE-bench Pro : Sonnet 5 atteint 63,2 %, contre 58,1 % pour Sonnet 4.6, avec Opus 4.8 toujours en tête à 69,2 %. C'est l'écart net le plus large de tout le tableau — six points. Si votre charge de travail est du codage autonome, multi-fichiers et difficile, c'est le chiffre qui devrait vous faire réfléchir. Opus est nettement meilleur ici, et nous reviendrons sur pourquoi ces six points d'écart pèsent plus lourd qu'il n'y paraît.

Codage agentique, Terminal-Bench 2.1 : Sonnet 5 bondit à 80,4 % contre 67,0 % pour 4.6 — un saut de treize points en une génération. Là où se situe Opus 4.8 sur ce harnais particulier est réellement contesté : certains rapports le placent quelques points devant Sonnet 5, d'autres le placent plusieurs points derrière, donc je ne vais pas fonder une conclusion sur Terminal-Bench dans un sens ni dans l'autre. Ce qui n'est pas contesté, c'est que Sonnet 5 a laissé son propre prédécesseur loin derrière ici.

Raisonnement multidisciplinaire, Humanity's Last Exam : Sans outils, 43,2 % contre 49,8 % pour Opus. Avec outils, 57,4 % contre 57,9 % pour Opus — pour ainsi dire ex æquo. Le résultat avec outils est révélateur : donnez à Sonnet 5 la possibilité de chercher et d'appeler des fonctions, et son écart de raisonnement avec Opus s'évapore presque. La plupart des vraies charges d'agents ont des outils. Gardez ça en tête.

Utilisation de l'ordinateur, OSWorld-Verified : 81,2 % contre 83,4 % pour Opus. Deux points. Pour piloter un navigateur ou un bureau, c'est du bruit sur la plupart des tâches.

Travail intellectuel, GDPval-AA v2 : Sonnet 5 score 1618. Opus 4.8 score 1615. Le modèle de milieu de gamme l'a emporté. Pas d'écrasement, mais victoire — sur le benchmark le plus proche de « faire du travail professionnel utile à travers les disciplines ».

Prenez du recul et la forme est sans équivoque : chute minime par rapport à Opus quasiment partout, une victoire nette sur le travail intellectuel, et exactement une catégorie — le codage agentique difficile — où Opus garde une vraie avance. C'est un fossé remarquablement étroit pour un modèle qui coûte plus de deux fois plus cher.

Ce qui nous amène à l'argent, parce que les benchmarks ne représentent que la moitié de la décision.

Le calcul de prix qui fait vraiment bouger l'aiguille

Les benchmarks vous disent ce qui est possible. Le prix vous dit ce qui est abordable à grande échelle. Et c'est ici que Sonnet 5 cesse d'être intéressant et devient disruptif.

Par million de tokens, voici la grille au lancement :

  • Fable 5 / Mythos 5 : 10 $ en entrée / 50 $ en sortie — le plafond premium
  • Opus 4.8 : 5 $ en entrée / 25 $ en sortie
  • Sonnet 5 : 2 $ en entrée / 10 $ en sortie

Lisez la ligne Sonnet 5 face à Opus. L'entrée est à 40 % du coût d'Opus. La sortie est à moins de la moitié. Ce n'est pas une remise — c'est une catégorie budgétaire différente.

Un détail que la couverture du jour de lancement a signalé et autour duquel il faut planifier : ces 2 $/10 $ sont un tarif d'introduction, valable jusqu'au 31 août 2026. Après cela, il monte à 3 $/15 $. Anthropic a fixé le tarif d'intro pour que la transition pour les utilisateurs Sonnet existants soit à peu près neutre en coût, mais si vous construisez une prévision sur ces chiffres, modélisez le tarif post-août. 3 $/15 $ reste nettement en dessous des 5 $/25 $ d'Opus — ce n'est simplement pas le rabais massif des deux premiers mois.

Rendons ça concret, parce que les chiffres par million de tokens ne parlent pas tant qu'on ne les met pas à l'échelle. Le chiffre qui a recadré tout ça pour moi : une charge d'agent gourmande en sortie qui coûte environ 1 000 $/jour sur Opus 4.8 atterrit près de 400 $/jour sur Sonnet 5 au tarif standard. Pour un développeur solo qui fait tourner un agent, on s'en fiche. Pour une équipe qui fait tourner des centaines d'agents en parallèle, c'est la frontière entre « ce produit a un modèle économique » et « ce produit est un projet scientifique ».

C'est la vraie histoire. Pas que Sonnet 5 soit bon — plein de modèles sont bons. C'est que Sonnet 5 est assez bon pour rendre Opus optionnel sur la majorité des charges de travail, tout en coûtant moins de la moitié pour les faire tourner. Pour tous ceux qui étaient exclus de Fable et Mythos par le prix, un modèle Claude capable vient d'atterrir dans un budget qu'ils peuvent réellement défendre.

Mais ces 60 % d'économies sont conditionnels. Il y a un réglage qui peut les effacer entièrement, et la plupart des équipes ne s'en apercevront qu'à l'arrivée de la facture.

Le piège du niveau d'effort dont personne ne vous parle

Voici la partie qui justifie l'existence de cet article. Sonnet 5 expose des niveaux d'effort — low, medium, high, xhigh, et max tout en haut du curseur. Un effort plus élevé signifie que le modèle dépense plus de tokens à raisonner avant de répondre. Plus de tokens de raisonnement signifie meilleure qualité et coût plus élevé. Les tokens de sortie sont là où réside la facture, et le raisonnement brûle des tokens de sortie.

Si vous avez lu mon analyse des niveaux d'effort d'Opus 4.8, vous savez déjà que ce curseur compte plus que le choix du modèle lui-même la moitié du temps. Avec Sonnet 5 il compte encore plus, parce que le curseur détermine si vous faites une bonne affaire ou si vous payez trop.

Parcourez-le comme les résultats de recherche agentique se déroulent réellement :

En low effort, Sonnet 4.6 bat encore Sonnet 5 sur le taux de réussite — Sonnet 5 se situe autour de 55 % sur la tâche de recherche agentique. Sonnet 5 est moins cher à ce réglage, donc vous échangez un peu de précision contre une facture plus basse. Bien pour du travail tolérant à gros volume.

En medium effort, les deux sont comparables en qualité, mais Sonnet 5 le fait pour moins cher. C'est le point idéal — le réglage où « moins cher et au moins aussi bon » est simplement vrai, sans astérisque.

En high effort, Sonnet 5 prend une avance nette sur 4.6 en qualité. Mais le coût grimpe, et voici le point crucial : Sonnet 5 en high effort coûte à peu près la même chose qu'Opus en high effort. Vous avez dépensé pour remonter jusqu'au prix d'Opus.

En xhigh — et Sonnet 5 monte encore d'un cran, jusqu'à max — vous êtes carrément au prix d'Opus. Au sommet du curseur, Sonnet 5 se situe autour du réglage medium-à-high d'Opus 4.8 sur OSWorld-Verified et sur le benchmark de recherche agentique BrowseComp. Vous payez potentiellement plus qu'Opus pour obtenir un résultat qui ne fait qu'égaler la vitesse intermédiaire d'Opus. Voilà le piège. Sonnet 5 poussé au maximum est, pour beaucoup de tâches, le pire des deux mondes — le prix d'Opus pour des plafonds inférieurs à Opus.

Donc la lecture naïve — « Sonnet 5 est moins cher, poussez-le à fond et économisez de l'argent » — est exactement à l'envers en haut du curseur. Les économies vivent en low et medium effort. Poussez au maximum et vous avez souvent juste construit un Opus plus lent et plus cher.

Cette asymétrie est la chose la plus importante à intérioriser à propos de ce modèle, et c'est pour ça que la réponse à « Sonnet 5 ou Opus 4.8 ? » n'est jamais tranchée.

Si vous préférez ne pas régler ce curseur à la main sur une flotte d'agents — déterminer les budgets d'effort par tâche est un travail vraiment minutieux — c'est exactement le genre d'architecture que je construis pour mes clients via mon profil Fiverr. Mais vous pouvez tout à fait le faire vous-même, et la règle ci-dessous est le point de départ que je recommanderais.

Alors, quand le modèle moins cher gagne-t-il vraiment ?

Enlevez la nuance et voici le cadre de décision que j'utilise désormais. Ce n'est pas « quel modèle est le meilleur ». C'est « de quoi cette tâche spécifique a-t-elle besoin, et où cela me place-t-il sur la courbe ».

Prenez Sonnet 5 quand :

  • Le travail est routinier à modérément complexe — génération de contenu, classification, extraction, résumé, codage standard type CRUD, la plupart du travail intellectuel. (Rappel : il a battu Opus sur GDPval-AA v2.)
  • Vous tournez à gros volume. Des centaines d'appels, des agents en parallèle, tout ce où le coût par appel s'accumule en un vrai chiffre.
  • Des outils sont dans la boucle. L'écart de raisonnement de Sonnet 5 face à Opus se referme presque une fois qu'il peut chercher et appeler des fonctions.
  • Vous pouvez rester en low ou medium effort. C'est là que l'avantage de coût est réel et inconditionnel.

Prenez Opus 4.8 quand :

  • La tâche est du codage autonome et difficile — refactorings multi-fichiers, débogage tordu, longues sessions de codage agentique. Ces six points d'écart sur SWE-bench Pro sont bien réels, et sur les problèmes vraiment difficiles, ils s'accumulent : l'efficacité d'Opus en tokens fait qu'il atteint souvent la réponse en moins d'étapes coûteuses. Sur les tâches de recherche agentique et d'usage d'ordinateur de haute complexité, Opus fournit fréquemment de meilleurs résultats à un coût total inférieur à Sonnet 5 poussé au maximum, précisément parce qu'il n'a pas besoin du haut du curseur pour y arriver.
  • La précision est non négociable et vous préférez ne pas surveiller la sortie.
  • Vous étiez sur le point de mettre Sonnet 5 en xhigh « par sécurité ». Si vous avez besoin de ce plafond, utilisez juste Opus — il est moins cher tout en haut et meilleur.

L'heuristique propre : Sonnet 5 possède la majorité low-à-medium effort de votre charge de travail ; Opus 4.8 possède la minorité high-effort, haute précision. La plupart des équipes trouveront que la majorité est plus grande qu'elles ne le pensaient, ce qui est exactement pourquoi ce lancement compte. Pour le tableau plus large du codage agentique en particulier, j'ai creusé la question dans mon test pratique de Sonnet 5 pour le codage agentique — ce billet en est le compagnon coût-et-décision.

Il y a encore une dimension qui n'apparaît pas du tout sur le graphique des benchmarks, et pour quiconque déploie des agents avec de vraies permissions, c'est peut-être la plus importante.

Et pour la sécurité, l'alignement et la sûreté ?

Le rapport coût-performance est le gros titre. Mais si vous confiez à un modèle l'accès à des outils, l'accès à des fichiers ou un navigateur, « comment se comporte-t-il quand les choses deviennent adverses » cesse d'être une question académique. Voici où atterrit Sonnet 5, avec la mise en garde qui va avec.

Les évaluations pré-déploiement d'Anthropic ont trouvé que Sonnet 5 est globalement une amélioration par rapport à Sonnet 4.6. Sur la sûreté agentique en particulier, il est meilleur pour refuser les requêtes malveillantes et plus résistant aux tentatives de détournement dans les attaques par injection de prompt — le mode d'échec précis qui me tient éveillé la nuit quand un agent a un accès en écriture à quoi que ce soit. Sur l'audit comportemental automatisé qui sonde pour des comportements mal alignés comme la tromperie et la coopération à l'usage abusif, Sonnet 5 a scoré plus sûr que son prédécesseur.

La mise en garde honnête : Sonnet 5 a montré des taux un peu plus élevés de comportement mal aligné que le plus capable Opus 4.8 et que la Mythos Preview. Plus de capacité a jusqu'ici corrélé avec un meilleur alignement dans cette famille, et Sonnet 5 se situe sous Opus en capacité. Donc si votre cas d'usage est réellement à enjeux élevés et adverse, c'est une coche de plus dans la colonne d'Opus — pas un critère éliminatoire pour Sonnet 5, mais un vrai facteur.

Sur la cybersécurité, la nouvelle est discrètement bonne. Anthropic n'a pas délibérément entraîné Sonnet 5 sur les tâches cyber. Il gère le travail cyber routinier et non nuisible, mais il performe substantiellement moins bien qu'Opus 4.8 et Mythos 5 sur les capacités dangereuses comme le développement d'exploits logiciels. Cette faiblesse est ici une fonctionnalité : Sonnet 5 ne porte pas le genre de capacité de développement d'exploits qui a poussé Anthropic à mettre des restrictions et une surveillance plus lourdes autour de Mythos (j'ai écrit sur tout cet épisode dans le décryptage du lancement de Fable 5 et Mythos 5). Le résultat est un modèle plus simple et plus stable à déployer largement. Il est également livré avec les protections cyber en temps réel activées par défaut — les mêmes qu'Anthropic faisait tourner sur Opus 4.7 et 4.8.

Bilan : pour la grande majorité du travail agentique, Sonnet 5 est sûr à déployer et se comporte mieux que le Sonnet que vous utilisiez le mois dernier. Pour les scénarios aux enjeux les plus élevés et les plus adverses, Opus garde l'avantage. Le même motif que tout le reste dans cette comparaison — et ce n'est pas une coïncidence.

Pourquoi ce lancement dépasse un simple modèle

Prenez du recul une seconde, parce que l'argument par token passe à côté du point stratégique.

Anthropic file vers une IPO majeure, et Sonnet 5 se lit comme un modèle construit autant pour le marché des tokens d'API que pour n'importe quel utilisateur individuel. Le ratio coût-performance est tout le champ de bataille concurrentiel pour l'inférence en ce moment, et Sonnet 5 est un coup direct pour le prendre — assez capable pour gérer de vraies charges de production, assez bon marché pour gagner les mises en concurrence face aux rivaux sur le prix.

Pour l'écosystème, il comble le milieu. Il y a maintenant un modèle Claude véritablement fort placé entre le palier d'entrée et le plafond Opus/Fable/Mythos, visant droit tous ceux qui ont regardé les 10 $/50 $ de Fable et ont discrètement fermé l'onglet. Ça fait beaucoup de monde. Beaucoup de startups. Beaucoup d'agents qui deviennent soudainement rentables.

Et parce que Sonnet et Opus partagent désormais une seule courbe coût-performance, la conversation d'architecture change. Vous cessez de demander « quel palier pour ce produit ? » et commencez à demander « quel point de la courbe pour chaque tâche ? » — en routant les tâches bon marché vers Sonnet 5 en low effort, en réservant Opus à la minorité difficile. C'est une façon plus sophistiquée et plus efficiente en coût de construire, et Sonnet 5 est le modèle qui la rend enfin pratique.

La seule chose à faire cette semaine

Ne prenez pas mon cadre pour argent comptant — et ne prenez pas les benchmarks pour argent comptant non plus. Ils sont indicatifs, pas parole d'évangile pour votre charge de travail.

Voici l'expérience de 30 minutes. Prenez une tâche que votre système exécute souvent. Faites-la tourner trois fois : Sonnet 5 en medium effort, Sonnet 5 en high effort, et Opus 4.8. Enregistrez la qualité de sortie et le coût en tokens pour chacune. Vous trouverez presque certainement l'une de deux choses — soit Sonnet 5 en medium effort suffit largement et vous venez de couper le coût de cette tâche de 60 %, soit la tâche nécessite véritablement Opus et vous en avez maintenant la preuve au lieu d'une intuition. L'une ou l'autre réponse vaut trente minutes.

Rappelez-vous où tout a commencé : mon raccourci paresseux à deux paliers, « tâche importante, prendre Opus ». Sonnet 5 n'a pas tué cet instinct — il l'a affûté. La question n'est plus quel modèle. C'est quel point de la courbe, tâche par tâche. Réussissez ce routage et vous ferez tourner la majorité de votre travail à 40 % du coût avec une qualité indistinguable, ne dépensant l'argent d'Opus que là où il vous achète réellement quelque chose.

Le modèle bon marché gagne plus souvent qu'on ne le croit. Juste pas au sommet du curseur.

Foire aux questions

Claude Sonnet 5 est-il meilleur que Opus 4.8 ?

Pas globalement — mais plus proche que l'écart de prix ne le suggère. Sonnet 5 traîne derrière Opus 4.8 d'à peine quelques points sur la plupart des benchmarks et le bat en fait sur le travail intellectuel (GDPval-AA v2 : 1618 vs 1615). Opus garde une avance nette sur le codage agentique difficile (SWE-bench Pro : 69,2 % vs 63,2 %). Pour le cadre de décision, voyez « Alors, quand le modèle moins cher gagne-t-il vraiment ? » plus haut.

Combien coûte Claude Sonnet 5 par rapport à Opus 4.8 ?

Sonnet 5 est à 2 $ en entrée / 10 $ en sortie par million de tokens (tarif d'introduction jusqu'au 31 août 2026), puis 3 $/15 $. Opus 4.8 est à 5 $/25 $. Donc Sonnet 5 tourne à environ 40 % du coût d'entrée d'Opus et à moins de la moitié du coût de sortie — une charge gourmande en sortie coûtant 1 000 $/jour sur Opus atterrit près de 400 $/jour sur Sonnet 5.

Quel est le piège du niveau d'effort de Sonnet 5 ?

À ses niveaux d'effort les plus élevés (xhigh et max), Sonnet 5 peut coûter autant ou plus qu'Opus 4.8 tout en n'égalant que la qualité medium-à-high d'Opus. L'avantage de coût vit en low et medium effort — poussez le curseur en haut et vous payez souvent le prix d'Opus pour un plafond inférieur à Opus. Décryptage complet dans la section « Le piège du niveau d'effort » plus haut.

Claude Sonnet 5 est-il sûr à déployer pour des agents ?

Oui pour la plupart des cas d'usage. Sonnet 5 est meilleur que Sonnet 4.6 pour refuser les requêtes malveillantes et résister aux détournements par injection de prompt, et il est livré avec les protections cyber en temps réel activées par défaut. La mise en garde : il montre des taux de comportement mal aligné un peu plus élevés qu'Opus 4.8, donc les charges les plus adverses et à enjeux les plus élevés favorisent toujours Opus.

Quand Claude Sonnet 5 est-il sorti ?

Claude Sonnet 5 a été lancé le 30 juin 2026, comme modèle par défaut pour les plans Free et Pro et est disponible pour les utilisateurs Max, Team et Enterprise ainsi que via l'API.

Avant de choisir un modèle

Si vous câblez Sonnet 5 et Opus 4.8 dans le même système et que vous voulez régler les budgets d'effort par tâche avant que la facture ne vous l'enseigne à la dure, ce routage coût-versus-qualité est exactement le genre de travail que je prends en charge — joignez-moi ici. Faites l'expérience de 30 minutes ci-dessus d'abord, cependant. La moitié du temps, elle vous dit que Sonnet 5 en medium effort couvrait déjà le travail.

Publicité
Coffee cup

Vous avez apprécié cet article ?

Votre soutien m'aide à créer davantage de contenu technique approfondi, d'outils open source et de ressources gratuites pour la communauté des développeurs.

Sujets connexes

Engr Mejba Ahmed

Engr Mejba Ahmed

Engr. Mejba Ahmed builds AI-powered applications and secure cloud systems for businesses worldwide. With 8+ years shipping production software in Laravel, Python, and AWS, he's helped companies automate workflows, reduce infrastructure costs, and scale without security headaches. He writes about practical AI integration, cloud architecture, and developer productivity.

Articles connexes

Tout parcourir

Comments

Leave a Comment

Comments are moderated before appearing.

Learning Resources

Expand Your Knowledge

Accelerate your growth with structured courses, verified certificates, interactive flashcards, and production-ready AI agent skills.

Sample Certificate of Completion

Sample certificate — complete any course to earn yours

Engr Mejba Ahmed

Engr Mejba Ahmed

AI assistant · trained on my work

👋

Hey there!

Quick Actions

WhatsApp Direct line to me

Chat on WhatsApp

+880 1723 741224 · Replies within the hour on working days

Popular Questions

Engr Mejba Ahmed is connected
Engr Mejba Ahmed is typing...
Engr Mejba Ahmed avatar

✉ Want me to follow up? Drop your email

Engr Mejba Ahmed avatar

📞 Connect Directly

Choose how you'd like to reach me

WhatsApp

+880 1723 741224

Email

mejba.13@gmail.com

✓ Details sent! I'll get back to you shortly.

Powered by OpenAI

335+

Blog Posts

25

AI Courses

63

Projects

Services & Expertise

Pricing & Process

Learning & Resources

Connect & Support