Claude Sonnet 5 : avis 2026, prix réel et comparaison avec Opus 4.8

Claude Sonnet 5 face à Opus 4.8 : notre avis sur ses performances, son prix API réel, le surcoût du tokenizer et les pièges de la migration.

Thursday, September 3, 2026Omid Saffari
Claude Sonnet 5 : avis 2026, prix réel et comparaison avec Opus 4.8

Claude Sonnet 5 est désormais le modèle par défaut de tous les comptes Free et Pro. Sur les tâches agentiques, il talonne Opus 4.8, tout en étant affiché à $2 par million de tokens en entrée jusqu’au 31 août. Mais la page des tarifs passe sous silence un détail : avec le nouveau tokenizer, une même tâche consomme environ 30% de tokens de plus qu’avec Sonnet 4.6. La facture réelle est donc moins avantageuse que le prix facial ne le laisse penser.

Le verdict en une phrase

Passez à Sonnet 5 pour les agents, le code et les automatisations qui enchaînent les outils, mais intégrez le changement de tokenizer à vos calculs avant de conclure qu’il coûte moins cher.

Anthropic a lancé Sonnet 5 le 30 juin 2026. C’est son modèle Sonnet le plus autonome à ce jour : il planifie les tâches en plusieurs étapes, pilote des outils comme un navigateur ou un terminal et mène à terme des missions sur lesquelles les précédents Sonnet finissaient par bloquer. Dans l’API comme dans Claude Code, il utilise par défaut effort=high. À ce niveau, il se rapproche d’Opus 4.8 sur certaines tâches pour une fraction du prix. Pour qui travaille déjà dans Claude Code ou développe des agents, c’est désormais le choix par défaut le plus logique.

La vraie raison de temporiser est financière, pas technique. Le tarif de lancement ressemble à une baisse, mais le nouveau tokenizer compte environ 30% de tokens supplémentaires pour un même texte. À cela s’ajoutent trois ruptures de compatibilité dans l’API : sans préparation, vos requêtes renverront une erreur 400. Les deux sujets sont détaillés ci-dessous.

Page produit de Claude Sonnet 5
Claude Sonnet 5

Claude Sonnet 5 face à Sonnet 4.6 : ce qui change vraiment

Sonnet 5 remplace directement Sonnet 4.6, avec un peu moins de contrôle manuel en échange d’une autonomie nettement supérieure.

Le progrès le plus visible concerne sa capacité à aller au bout d’une tâche agentique. Anthropic reconnaît que les avancées les plus nettes se concentraient récemment sur les modèles de la gamme Opus. Sonnet 5 réduit cet écart : ses performances se rapprochent de celles d’Opus 4.8 à moindre coût, avec bien plus de combinaisons possibles entre prix et vitesse que Sonnet 4.6. Par rapport à la version 4.6, il progresse en raisonnement, en utilisation d’outils, en programmation et dans les tâches intellectuelles. Les partenaires ayant bénéficié d’un accès anticipé l’ont vu terminer des développements en plusieurs étapes et vérifier spontanément son propre travail. Sur les benchmarks mis en avant par Anthropic — la recherche agentique (BrowseComp) et l’utilisation d’un ordinateur (OSWorld-Verified) — il surpasse clairement la version 4.6 et peut, avec un effort plus élevé, égaler Opus 4.8 sur certaines tâches. D’après le rapport de sécurité d’Anthropic, il adopte aussi moins souvent des comportements indésirables que la version 4.6 et reste sensiblement moins performant en cybersécurité que les modèles Opus actuels — un avantage, plus qu’une lacune, pour la plupart des usages en entreprise.

Le changement de comportement le plus utile tient en une ligne : la réflexion adaptative est activée par défaut. Avec Sonnet 4.6, une requête dépourvue du champ thinking s’exécutait sans réflexion. La même requête déclenche désormais une réflexion adaptative avec Sonnet 5. Les réponses s’améliorent sans réglage préalable, mais max_tokens plafonne à la fois les tokens de réflexion et ceux de la réponse. Une limite de sortie calibrée pour la version 4.6 peut donc tronquer le texte visible. Réévaluez max_tokens pour chaque workflow qui fonctionnait auparavant sans réflexion.

Le vrai prix de Claude Sonnet 5 dans la gamme Claude 5

Le tarif de lancement de Sonnet 5 est de $2 par million de tokens en entrée et $10 par million de tokens en sortie jusqu’au 31 août 2026. Il passera ensuite à $3 en entrée et $15 en sortie. Voici comment il se situe dans la gamme aux tarifs actuels :

ModèleID APIPrix (entrée / sortie par MTok)ContexteSortie maximale
Claude Fable 5claude-fable-5$10 / $501M128k
Claude Opus 4.8claude-opus-4-8$5 / $251M128k
Claude Sonnet 5claude-sonnet-5$2 / $10 intro, puis $3 / $151M128k
Claude Haiku 4.5claude-haiku-4-5$1 / $5200k64k

Exprimée en rapports de prix, la décision devient plus lisible. Au tarif de lancement, Sonnet 5 revient à 40% du prix d’Opus 4.8 par token ; même au tarif standard appliqué après août, il reste à 60% du prix d’Opus. Dans l’autre sens, son tarif standard représente 3x le prix de Haiku 4.5. Haiku est toutefois limité à une fenêtre de contexte de 200k, contre 1M pour Sonnet 5. Celui-ci occupe donc volontairement le milieu de la gamme : moins cher qu’Opus, nettement plus puissant que Haiku, avec le même contexte de 1M et le même plafond de sortie de 128k que les modèles phares.

Une caractéristique discrète compte beaucoup pour les tâches longues : Sonnet 5 conserve une fenêtre de contexte de 1M tokens, à la fois par défaut et au maximum — aucune variante à contexte réduit n’est proposée. Sur la Batch API, il peut générer jusqu’à 300k tokens en sortie avec le header bêta output-300k-2026-03-24. Par rapport à la gamme Opus, il perd en revanche l’accès au Priority Tier, indisponible avec Sonnet 5.

Comparatif des prix et capacités de la gamme Claude 5
La place de Sonnet 5 : moins cher qu’Opus, bien plus puissant que Haiku, avec le même contexte de 1M.

Le surcoût du tokenizer que le prix ne montre pas

Le tarif affiché a baissé, mais le coût réel d’une même tâche n’a pas diminué dans les mêmes proportions. Sonnet 5 utilise en effet un nouveau tokenizer qui produit environ 30% de tokens supplémentaires à partir du même texte par rapport à Sonnet 4.6.

Le tokenizer découpe votre texte en unités facturables, les tokens. Celui de Sonnet 5 diffère de celui de la version 4.6 et, comme Anthropic l’indique clairement, un texte identique génère environ 30% de tokens en plus — la valeur exacte varie selon le contenu. Le tarif unitaire ne change pas. Mais puisque la facturation dépend du nombre de tokens, une requête qui en comptait 10,000 avec la version 4.6 en produit désormais environ 13,000 : à tâche équivalente, le coût augmente d’environ 30% avant même de tenir compte du nouveau tarif. Cela signifie aussi que la fenêtre de contexte de 1M contient moins de texte réel et qu’une limite max_tokens dimensionnée pour les sorties de la version 4.6 peut interrompre prématurément une réponse.

La règle à retenir : cessez de réutiliser des volumes de tokens mesurés avec les anciens modèles et refaites vos calculs sur Sonnet 5. Si vos prévisions de coûts, vos budgets par requête ou votre logique de remplissage du contexte reposent sur les mesures de la version 4.6, ils sont désormais trop optimistes. La gamme Opus a déjà connu le même phénomène, analysé en détail dans mon article sur le changement de tokenizer d’Opus 4.7. La solution reste identique : recomptez, puis décidez.

Une même phrase consomme environ 30% de tokens supplémentaires avec Sonnet 5
Le tarif par token reste inchangé, mais un même texte génère une facture supérieure d’environ 30%.

Sonnet 5 n’en devient pas cher pour autant. Au tarif de lancement, il reste très en dessous d’Opus pour un résultat comparable. La comparaison honnête n’est donc pas « il est devenu bon marché », mais « un prix facial de $2, un vrai gain de capacités et un surcoût d’environ 30% en tokens ». Faites le calcul sur vos propres workloads avant d’anticiper des économies.

Trois incompatibilités à corriger avant de migrer

La migration depuis la version 4.6 est globalement simple, mais trois requêtes encore valides hier déclenchent maintenant une erreur 400. Corrigez-les d’abord, faute de quoi votre boucle d’agent échouera dès le premier appel.

  1. Supprimer les paramètres d’échantillonnage

    Attribuer une valeur non standard à temperature, top_p ou top_k provoque une erreur 400 avec Sonnet 5. Retirez ces paramètres de la requête ; leur valeur par défaut, ou leur absence, est acceptée. Pour orienter le comportement du modèle, transférez vos consignes dans le prompt système. Cette restriction est nouvelle dans la gamme Sonnet, mais s’appliquait déjà à Opus 4.7.

  2. Abandonner la réflexion étendue manuelle

    L’ancienne forme thinking: {type: "enabled", budget_tokens: N} a disparu et renvoie une erreur 400. Utilisez plutôt la réflexion adaptative avec le paramètre effort, comme sur Opus 4.8. Pour désactiver entièrement la réflexion, transmettez thinking: {type: "disabled"}.

  3. Revérifier max_tokens

    La réflexion adaptative étant active par défaut et max_tokens plafonnant ensemble la réflexion et la réponse, testez à nouveau toute limite dimensionnée pour la version 4.6. Les workloads qui fonctionnaient jusque-là sans réflexion sont les plus susceptibles d’être tronqués.

Python
# Fails on Sonnet 5 (returns 400)
resp = client.messages.create(
    model="claude-sonnet-5",
    temperature=0.7,
    thinking={"type": "enabled", "budget_tokens": 32000},
    max_tokens=4000,
    messages=[...],
)

# Works: no sampling params, adaptive thinking, roomier max_tokens
resp = client.messages.create(
    model="claude-sonnet-5",
    thinking={"type": "adaptive"},
    max_tokens=8000,
    messages=[...],
)

Claude Sonnet 5 ou Opus 4.8 : quand choisir le modèle moins cher ?

Pour le développement agentique et les automatisations qui utilisent des outils, Sonnet 5 avec effort=high constitue le meilleur point de départ. Opus 4.8 ne s’impose que lorsque la tâche exige réellement le niveau de performance maximal.

L’atout de Sonnet 5 est son réglage d’effort. Il propose les mêmes niveaux medium, high et extra-high que la gamme Opus. Les courbes coût-performance d’Anthropic montrent aussi qu’il couvre un éventail bien plus large que la version 4.6 : efficace avec un effort moyen, il atteint, à un niveau supérieur, les capacités d’Opus 4.8 sur certaines tâches. Comme son prix correspond à 40% de celui d’Opus au lancement — puis à 60% après août —, mieux vaut commencer avec Sonnet 5 et réserver Opus aux tâches difficiles qui le nécessitent, plutôt que de tout exécuter au tarif d’Opus.

Les raisons de rester sur Opus 4.8 sont limitées, mais solides : les travaux pour lesquels le sommet de la courbe de performance rentabilise son prix, le développement agentique le plus complexe, les longues exécutions autonomes où une seule étape ratée coûte cher, ou les situations dans lesquelles « égaler Opus sur certaines tâches » ne suffit pas précisément parce que les tâches décisives sont les autres. Pour des traitements de production délégués sans surveillance et à grande échelle, l’écart tarifaire peut coûter moins cher qu’un seul échec de Sonnet.

Un accueil partagé : pourquoi certains parlent de régression

Les réactions de la communauté sont contrastées ; les ignorer serait malhonnête. À côté d’éloges résumés par la formule "finishes tasks 4.6 couldn't", plusieurs fils de discussion publics ouverts ce mois-ci sur r/ClaudeAI affichent des titres sans détour : "Sonnet 5 is a downgrade", mais aussi "is it actually worth using" et "what's the consensus". Le décalage entre la formule d’Anthropic, "close to Opus 4.8", et le ressenti de certains utilisateurs mérite d’être signalé.

Deux facteurs expliquent l’essentiel de cet écart. D’abord, la réflexion adaptative activée par défaut modifie la forme des réponses et leur latence. Un workflow réglé pour les sorties plus brèves et sans réflexion de la version 4.6 peut donc paraître différent, même si la qualité progresse. Ensuite, le nouveau tokenizer rend les comparaisons de coût moins flatteuses tant que les utilisateurs n’ont pas refait leurs mesures : ils voient d’abord « plus cher » avant de comprendre qu’il s’agit d’un tokenizer différent. Rien de tout cela ne fait de Sonnet 5 un mauvais modèle ; cela rappelle simplement qu’une mise à niveau annoncée comme directe ne l’est jamais tout à fait. Testez-le sur vos propres prompts avant de vous fier au verdict de quiconque — y compris au mien.

Qui devrait migrer maintenant, et qui devrait attendre ?

Vous développez des agents, livrez du code avec Claude Code ou exploitez des automatisations qui enchaînent les outils. Sonnet 5 avec effort=high offre une exécution proche d’Opus au tarif Sonnet. Migrez, mais recalculez d’abord vos budgets de tokens.

Arbre de décision pour migrer vers Sonnet 5
Un arbre de décision rapide pour choisir entre migrer et conserver son modèle actuel.
Claude Sonnet 5 est-il déjà disponible ?

Oui. Lancé le 30 juin 2026, il est devenu le modèle par défaut des forfaits Free et Pro. Il est également accessible aux utilisateurs Max, Team et Enterprise, dans Claude Code et via l’API Claude sous l’identifiant claude-sonnet-5.

Combien coûte Claude Sonnet 5 ?

Le tarif de lancement de l’API est de $2 par million de tokens en entrée et de $10 par million de tokens en sortie jusqu’au 31 août 2026, puis de $3 en entrée et $15 en sortie. Cela représente 40% du tarif d’Opus 4.8 pendant la période de lancement, puis 60%. Attention : avec le nouveau tokenizer, un même texte compte environ 30% de tokens de plus qu’avec Sonnet 4.6.

Claude Sonnet 5 est-il vraiment performant ou marque-t-il une régression ?

Il améliore clairement Sonnet 4.6 sur les tâches agentiques, le code et l’utilisation d’outils, et se rapproche d’Opus 4.8 aux niveaux d’effort élevés. Certains utilisateurs le trouvent pourtant moins bon, principalement parce que la réflexion adaptative est désormais active par défaut et que le nouveau tokenizer gonfle les coûts avant recalcul. Testez-le avec vos propres prompts.

Claude Sonnet 5 est-il meilleur que GPT-5.6 ?

Le résultat dépend de la tâche. Sonnet 5 se distingue par sa capacité à mener les tâches agentiques jusqu’au bout et à utiliser des outils pour un prix réduit. Pour l’autre versant du comparatif, consultez le test de GPT-5.6.

Vous préparez la migration d’un environnement de code ou d’agents et voulez commencer par les réglages qui comptent vraiment ? Téléchargez gratuitement la checklist de configuration Claude Code + Codex : elle réunit les étapes de configuration et de maîtrise des coûts à appliquer avant de changer de modèle en production. Vous recevrez aussi chaque nouvelle analyse de modèle dès sa publication.

Dernière mise à jour

3 sept. 2026

CatégorieAI

Préférez ce site dans Google

Ajouter omidsaffari.com comme source préférée dans la recherche Google

Marquez omidsaffari.com comme source préférée et Google le met en avant pour vous dans Top Stories, AI Overviews et AI Mode.

Newsletter

Une lettre, chaque dimanche. Des systèmes qui tournent, pas des hot takes.

Build logs, systèmes en production et notes de terrain d'un portefeuille de ventures IA.

Hebdomadaire. Pas de spam. Désabonnement à tout moment.