Tarifs+7% bonus
Schuyler Stacy2026-07-01

Claude Sonnet 5 : nouveautés, coût et comparaison avec Sonnet 4.6 (guide 2026)

Guide de Claude Sonnet 5 : nouveautés par rapport à Sonnet 4.6, benchmarks, tarifs de 2 $/10 $, le piège du tokenizer qui modifie votre facture et du code API exécutable.

Claude Sonnet 5 : nouveautés, coût et comparaison avec Sonnet 4.6 (guide 2026)

Anthropic a lancé Claude Sonnet 5 le 30 juin 2026 et, en moins d'une heure, mes fils d'actualité regorgeaient des mêmes deux questions : faut-il abandonner Sonnet 4.6, et l'affirmation selon laquelle il propose « le même tarif catalogue que 4.6 » est-elle vraiment vraie une fois qu'on lui soumet un trafic réel ? Ce sont aussi les questions qui m'intéressent, alors ce guide s'articule autour d'elles plutôt qu'autour du florilège de points forts de l'annonce. Tout ce qui est technique ici s'appuie sur l'annonce et la documentation d'Anthropic ; lorsqu'un chiffre provient de la presse plutôt que d'une page que j'ai pu consulter directement, je le précise.

Commençons par un point important, car de nombreux premiers articles se trompent : le prédécesseur de Sonnet 5 est Sonnet 4.6 (sorti en février 2026), et non Sonnet 4.5. Si vous le comparez à 4.5 ou à un modèle encore plus ancien comme 3.5, vous comparez deux mises à niveau, et les chiffres ci-dessous ne correspondront pas. J'y reviendrai.

Table des matières

Qu'est-ce que Claude Sonnet 5 ?

Sonnet 5 est le nouveau modèle intermédiaire d'Anthropic, présenté comme son Sonnet le plus agentique à ce jour : il planifie, pilote des navigateurs et des terminaux, et exécute seul des tâches en plusieurs étapes. L'angle privilégié par Anthropic est celui du rapport coût-performances — des performances proches d'Opus 4.8, au tarif de Sonnet.

Cette présentation est importante avant d'aborder les aspects pratiques : pendant la majeure partie de l'année dernière, les progrès agentiques les plus significatifs ont été réalisés dans la gamme Opus, et non Sonnet. Les équipes qui exécutaient des tâches agentiques à grande échelle devaient donc payer les tarifs d'Opus pour des capacités dont elles n'avaient besoin qu'une partie du temps. Sonnet 5 est la tentative d'Anthropic de faire descendre une partie de ces capacités dans une gamme tarifaire inférieure. Voilà le « pourquoi », et cela explique la plupart des choix de conception qui suivent.

D'après la documentation d'Anthropic, voici les aspects pratiques : il s'agit d'un remplacement direct de Sonnet 4.6, il utilise l'identifiant de modèle API claude-sonnet-5, propose une fenêtre de contexte d'un million de tokens par défaut et au maximum, et prend en charge jusqu'à 128 000 tokens en sortie. Texte et images en entrée, texte en sortie.

  Claude Sonnet 5
Date de sortie 30 juin 2026
Identifiant de modèle API claude-sonnet-5
Fenêtre de contexte 1 million de tokens (par défaut et maximum)
Sortie maximale 128 000 tokens
Entrée / sortie Texte + image en entrée, texte en sortie
Relation avec 4.6 Remplacement direct

Quoi de neuf par rapport à Sonnet 4.6 ?

Si vous utilisez déjà Sonnet 4.6, la mise à niveau ne consiste pas seulement en une évolution des poids. Selon la documentation d'Anthropic, trois changements de comportement affecteront votre code :

  • La réflexion adaptative est activée par défaut.
  • La réflexion étendue manuelle renvoie désormais une erreur 400 (elle était déjà obsolète dans 4.6).
  • Définir des paramètres d'échantillonnage — temperature, top_p, top_k — sur des valeurs non définies par défaut renvoie une erreur 400.
    Deux autres changements ont une importance opérationnelle. Sonnet 5 propose des niveaux d'effort (low, medium, high et xhigh) : plus l'effort est élevé, plus de tokens sont consacrés au raisonnement afin d'obtenir une meilleure qualité — et un coût supérieur. C'est également le premier modèle de la gamme Sonnet à intégrer par défaut de véritables protections cyber en temps réel. Ces protections ont une particularité à connaître avant de l'intégrer à un agent : lorsque le modèle refuse une requête signalée, le refus revient sous la forme d'une réponse HTTP 200 réussie avec stop_reason: "refusal", et non sous la forme d'une erreur. Si votre gestion des erreurs suppose qu'un refus déclenche une exception, ce ne sera pas le cas.

Le changement qui aura toutefois le plus grand impact est celui que personne ne met dans les titres : le tokenizer. Je lui consacre une section, car il modifie le calcul des coûts.

Fonctionnalités et performances

Anthropic présente Sonnet 5 comme une amélioration nette par rapport à 4.6 en matière de raisonnement, d'utilisation d'outils, de programmation et de travail de connaissance, et comme suffisamment proche d'Opus 4.8 pour vous permettre de choisir votre position sur la courbe coût-performances grâce à la molette d'effort. Les chiffres précis des benchmarks ci-dessous proviennent des documents de lancement d'Anthropic et de la couverture du premier jour ; considérez-les comme rapportés par Anthropic jusqu'à ce que vous les ayez lus vous-même dans le System Card.

Benchmark Sonnet 5 Sonnet 4.6 Opus 4.8
SWE-bench Pro (programmation agentique) 63.2% 58.1% 69.2%
OSWorld-Verified (utilisation d'ordinateur) 81.2% 78.5% —
Terminal-Bench 2.1 80.4% 67.0% —
Humanity's Last Exam (avec outils) 57.4% 46.8% 57.9%
GDPval-AA v2 (travail de connaissance) 1,618 — 1,615

Chiffres tels que rapportés lors du lancement d'Anthropic le 30 juin 2026 ; les tirets correspondent aux cellules que je n'ai pas pu confirmer.

Lisez honnêtement ce tableau et deux éléments ressortent. En programmation, Sonnet 5 dépasse 4.6 avec une marge réelle, mais reste en dessous d' Opus 4.8  — l'écart se réduit, mais ne disparaît pas. En matière de travail de connaissance, il devance Opus 4.8 d'un cheveu (1 618 contre 1 615), ce qui explique l'affirmation « bat parfois Opus » que vous verrez répétée partout ; elle est vraie, mais de très peu, sur un seul benchmark.

Voici ce que le florilège de points forts ne dit pas sur le coût. Les propres graphiques d'Anthropic montrent que le meilleur rapport qualité-prix de Sonnet 5 se situe avec un effort faible ou moyen. Passez à xhigh, et les articles publiés le jour du lancement indiquent que le coût peut dépasser celui d'Opus 4.8 pour une qualité similaire. Ainsi, « moins cher qu'Opus » doit être assorti d'un astérisque : moins cher aux niveaux d'effort auxquels on choisirait réellement Sonnet, pas nécessairement lorsqu'on le pousse au maximum. Mon avis : si une tâche a réellement besoin d'un raisonnement xhigh, comparez le prix avec Opus 4.8 avant de choisir Sonnet 5 par défaut — l'intuition selon laquelle le modèle plus petit est toujours moins cher ne tient plus au sommet de la molette.

En matière de sécurité, Anthropic rapporte des taux plus faibles d'hallucinations, de complaisance et de comportements indésirables qu'avec 4.6, ainsi qu'une meilleure résistance aux requêtes malveillantes et aux détournements par injection de prompt. La réserve qu'ils publient eux-mêmes : Sonnet 5 présente encore un taux de comportements mal alignés supérieur à celui d'Opus 4.8 lors de leur audit interne. Quant à la cybersécurité, il n'a jamais produit d'exploit complet et fonctionnel pendant les tests — une capacité volontairement faible dans ce domaine, ce qui est un avantage si vous déployez un agent destiné aux clients et une limite si votre cas d'usage concerne des travaux de sécurité autorisés.

Tarification de Claude Sonnet 5 : est-il vraiment moins cher ?

Les tarifs affichés — directement auprès d'Anthropic, ainsi que les tarifs actuels de GPT Proto :

  Entrée / 1 million Sortie / 1 million
Sonnet 5 — lancement (jusqu'au 31 août 2026) $2 $10
Sonnet 5 — standard (à partir du 1er septembre 2026) $3 $15
Sonnet 5 — via GPT Proto (actuel) $1.6 $8
Sonnet 4.6 $3 $15
Opus 4.8 $5 $25

Au tarif standard, Sonnet 5 coûte le même prix par token que 4.6 et reste nettement moins cher qu'Opus 4.8. Simple. Sauf que le prix par token ne représente pas toute la facture.

Sonnet 5 utilise un nouveau tokenizer — le même qu'Anthropic a introduit avec Opus 4.7 — et le même texte correspond désormais à environ 1,0 à 1,35 fois plus de tokens selon le type de contenu. Anthropic l'indique clairement dans une note de bas de page, ainsi que la conséquence : le tarif de lancement est fixé de manière à ce que le passage depuis 4.6 soit à peu près neutre en termes de coût pendant la période de lancement. Lisez attentivement. Cela signifie que le tarif de lancement de 2 $/10 $ n'est pas une pure remise ; une partie compense les tokens supplémentaires. Et cela signifie qu'au 1er septembre, lorsque le prix reviendra à 3 $/15 $ — identique à celui de 4.6 sur le papier — une requête équivalente pourra vous coûter plus cher qu'avec 4.6, car davantage de tokens seront facturés pour le même texte.

Alors, Sonnet 5 est-il moins cher que 4.6 ? La réponse honnête est : cela dépend de la date et de l'intensité d'utilisation. Jusqu'à fin août, effectivement oui. Ensuite, pour la même charge de travail, prévoyez un coût par requête stable ou légèrement supérieur, et non inférieur — mesurez vos propres prompts avec le nouveau tokenizer au lieu de vous fier à la ligne du prix par token.

Si vous appelez Claude via GPT Proto plutôt que directement, Sonnet 5 est disponible sur la plateforme au tarif de 1,6 $ / million de tokens en entrée et 8 $ / million en sortie — 20 % de moins que le tarif de lancement d'Anthropic de 2 $/10 $, ce qui en fait l'option la moins chère pendant la durée de cette offre. À titre de comparaison, sur la même plateforme, Sonnet 4.6 coûte 2,4 $/12 $ et Opus 4.8 4 $/20 $. Les appels exécutables de la section suivante ciblent directement Sonnet 5.

Comment utiliser Claude Sonnet 5 via l'API

Sonnet 5 est désormais disponible sur GPT Proto ; les exemples exécutables ci-dessous l'appellent directement depuis la page du modèle Claude Sonnet 5. Si vous migrez depuis 4.6, il s'agit du remplacement direct annoncé par Anthropic : remplacez claude-sonnet-4-6 par claude-sonnet-5 et ne modifiez rien d'autre dans l'appel.

GPT Proto expose Claude au format Messages natif d'Anthropic à l'adresse https://gptproto.com/v1/messages, avec un token Bearer. Commençons par cURL :

curl --request POST "https://gptproto.com/v1/messages" \
  --header "Authorization: Bearer $GPTPROTO_API_KEY" \
  --header "Content-Type: application/json" \
  --header "anthropic-version: 2023-06-01" \
  --data '{
    "model": "claude-sonnet-5",
    "max_tokens": 1024,
    "messages": [
      { "role": "user", "content": "Explain what an agentic coding model does in two sentences." }
    ]
  }'

Le même appel en Python, en utilisant uniquement requests :

import os
import requests
 
resp = requests.post(
    "https://gptproto.com/v1/messages",
    headers={
        "Authorization": f"Bearer {os.environ['GPTPROTO_API_KEY']}",
        "Content-Type": "application/json",
        "anthropic-version": "2023-06-01",
    },
    json={
        "model": "claude-sonnet-5",
        "max_tokens": 1024,
        "messages": [
            {"role": "user", "content": "Explain what an agentic coding model does in two sentences."}
        ],
    },
    timeout=60,
)
resp.raise_for_status()
data = resp.json()
print(data["content"][0]["text"])

Deux éléments à retenir lors de votre migration vers Sonnet 5. Premièrement, le changement de tokenizer signifie que le nombre de tokens — et donc votre facture ainsi que la marge disponible pour max_tokens — évolue même si le texte ne change pas ; remesurez avant de supposer que vos limites actuelles sont toujours suffisantes. Deuxièmement, si votre code actuel définit temperature, top_p ou top_k sur des valeurs personnalisées, ou active la réflexion étendue manuelle, supprimez ces paramètres : avec Sonnet 5, ils renvoient une erreur 400.

Une seule clé GPT Proto vous donne accès à Claude et à plus de 200 autres modèles avec un solde unique. Vous pouvez ainsi comparer Sonnet 5 à un modèle moins cher sur le même chemin de requête, sans jongler entre les fournisseurs. La liste complète se trouve dans le catalogue des modèles.

Sonnet 5 contre Sonnet 4.6 (et si vous utilisez encore 4.5 ou 3.5)

Voici la comparaison directe que j'utiliserais réellement pour décider, en conservant Opus 4.8 comme plafond de référence :

  Sonnet 5 Sonnet 4.6 Opus 4.8
Positionnement Travail agentique proche d'Opus au tarif de Sonnet Référence précédente du milieu de gamme Plafond de précision
Programmation (SWE-bench Pro) 63.2% 58.1% 69.2%
Meilleur rapport qualité-prix avec Effort faible / moyen — Tâches les plus difficiles
Tarif standard (entrée/sortie par million) $3 / $15 $3 / $15 $5 / $25
Contexte 1 million jusqu'à 1 million 200 000
Réserve concernant le coût Le nouveau tokenizer facture davantage de tokens ; xhigh peut dépasser le coût d'Opus Tokenizer familier Tarif adapté au haut de gamme

Mon analyse : si vous utilisez 4.6 et effectuez un travail agentique ou de programmation soutenu, Sonnet 5 est la mise à niveau à essayer — les gains en programmation et en utilisation d'outils sont réels, et le tarif de lancement rend l'essai peu coûteux. Si votre charge de travail exige une précision maximale — le genre de tâche où une mauvaise réponse coûte cher — gardez Opus 4.8 dans la boucle et réservez Sonnet 5 au volume intermédiaire. Et si vous utilisez constamment l'effort xhigh, c'est le signe qu'il faut chiffrer Opus 4.8, pas supposer que Sonnet est moins cher.

Vous utilisez encore Sonnet 4.5 ou 3.5 ? Le dossier en faveur de la mise à niveau est alors encore plus solide, mais je m'abstiendrais de vous citer un benchmark propre « 5 contre 3.5 », car Anthropic n'en a pas publié ; tous les chiffres de comparaison ci-dessus concernent 4.6. Ce que je peux dire, c'est que la tendance est claire : deux générations de progrès agentiques séparent 3.5 et 5, notamment en matière d'utilisation d'outils et de fiabilité sur les tâches longues, domaines où les anciens Sonnet atteignaient leurs limites. Quelle que soit votre version de départ, la démarche pratique est la même : dirigez votre code vers Sonnet 5 sur GPT Proto et laissez la molette d'effort faire le reste.

Est-ce que cela en vaut la peine ? Une analyse honnête

L'accueil du premier jour a été partagé, et cette division est instructive. Les éloges se concentraient sur le rapport qualité-prix au tarif de lancement. Les doutes portaient sur la même question autour de laquelle ce guide revient sans cesse : le modèle tient-il ses promesses lorsque le tarif standard de 3 $/15 $ revient et que l'inflation des tokens due au tokenizer fait discrètement son travail ?

Le signal le plus utile que j'ai vu n'était pas un benchmark, mais un test pratique réalisé par une équipe spécialisée dans les outils de revue de code, qui l'a utilisé sur du travail réel. Leur conclusion va dans les deux sens, ce qui la rend crédible : pour écrire et construire du code, Sonnet 5 était le modèle le plus performant qu'ils aient utilisé dans cette gamme. Pour la revue de code, c'était un compromis : des commentaires plus clairs et plus précis, mais moins de bugs détectés que par les modèles déjà utilisés en production, pour un coût légèrement supérieur par revue. Ils ont également relevé deux habitudes qui se traduisent par des gains de productivité dans les boucles agentiques : il a tendance à écrire les tests avant la fonctionnalité et réécrit son propre plan au milieu d'une tâche longue au lieu de suivre aveuglément un plan devenu obsolète. La réserve qu'ils ont signalée rejoint la note d'Anthropic : les nouvelles protections cyber déclencheront parfois un refus sur des travaux de sécurité légitimes.

À retenir : les citations élogieuses de l'annonce proviennent de partenaires ayant bénéficié d'un accès anticipé. Elles sont authentiques, mais sélectionnées, et les témoignages choisis par un fournisseur ne constituent pas une preuve neutre. Le retour indépendant issu d'une expérience pratique — très performant pour la génération, moins bon et plus cher pour la revue — constitue une base plus honnête.

Alors, qui devrait passer à Sonnet 5 ? Les équipes qui font beaucoup de programmation, utilisent des outils, automatisent des navigateurs et des terminaux, ou réalisent un travail de connaissance pour lequel elles payaient trop cher Opus — passez-y, et faites-le pendant la période de lancement, tant que l'essai est peu coûteux. Les équipes dont le processus principal repose sur des revues minutieuses ou des décisions exigeant une grande précision — testez-le, mais ne retirez pas votre modèle actuel dès le jour du lancement et relancez votre propre suite d'évaluations avant de vous engager.


En résumé : Sonnet 5 constitue une véritable avancée pour le travail agentique et la programmation, et le tarif de lancement le rend peu coûteux à essayer. Mais ne traduisez pas « même tarif catalogue que 4.6 » par « même facture », et comparez le prix d'Opus 4.8 avant de pousser la molette d'effort au maximum. Vous pouvez appeler Claude Sonnet 5 sur GPT Proto dès aujourd'hui au tarif de 1,6 $ / 8 $ — 20 % sous le tarif de lancement d'Anthropic — avec un solde et une clé API uniques, parmi plus de 200 modèles si vous souhaitez rediriger les appels sensibles au coût vers d'autres modèles.

Studio créatif

Générez images, vidéos et plus avec les API de production.

Commencer à créer
Studio créatif
Modèles associés
Tous les modèles
Claude
10% OFF
Claude
10% OFF
Claude
10% OFF
OpenAI
20% OFF

FAQ

Claude Sonnet 5 est-il disponible ?

Oui. Anthropic l'a lancé le 30 juin 2026 comme modèle par défaut pour les forfaits Free et Pro, sélectionnable pour les forfaits Max, Team et Enterprise, et disponible dans Claude Code ainsi que via l'API. Il est également disponible sur GPTProto : vous pouvez l'appeler depuis la page du modèle Claude Sonnet 5.

Combien coûte Claude Sonnet 5 ?

2 $ par million de tokens en entrée et 10 $ par million de tokens en sortie jusqu'au 31 août 2026, puis 3 $ / 15 $. Une réserve toutefois : il utilise un nouveau tokenizer qui transforme le même texte en environ 1,0 à 1,35 fois plus de tokens. Mesurez donc vos propres prompts au lieu de calculer le coût uniquement à partir du tarif par token.

Sonnet 5 est-il réellement moins cher que Sonnet 4.6 ?

Jusqu'à fin août, effectivement oui. Après la période de lancement, son tarif par token est identique à celui de 4.6, mais le nouveau tokenizer facture davantage de tokens pour le même texte. Une requête équivalente peut donc coûter légèrement plus cher, et non moins. Cela dépend de votre volume et de la date.

Puis-je remplacer directement Sonnet 4.6 par Sonnet 5 dans mon code ?

Pour l'essentiel, oui. Il s'agit d'un remplacement direct, le principal changement étant la chaîne de modèle. Mais remesurez le nombre de tokens et la valeur de max_tokens avec le nouveau tokenizer, et supprimez les paramètres d'échantillonnage personnalisés (temperature, top_p, top_k) ainsi que les appels de réflexion étendue manuelle : ils renvoient une erreur 400 avec Sonnet 5.

Articles associés

Plus de blogs
API Claude 4.5 : guide complet de configuration, de tarification et d’intégration pour les développeurs

API Claude 4.5 : guide complet de configuration, de tarification et d’intégration pour les développeurs

TL;DR Claude 4.5 (released September 2025) features Sonnet 4.5—the world's best coding model—and Haiku 4.5, both with extended thinking capabilities. Sonnet 4.5 achieves 77.2% on SWE-bench, operates autonomously for 30+ hours, and maintains pricing at $3/$15 per million tokens. Haiku 4.5 delivers near-frontier intelligence at $1/$5—one-third the cost with 2x the speed. Both support new features: memory tool, context editing, and hybrid reasoning modes.

Schuyler Stacy | 2026-02-03

Claude Fable 5 : guide complet et avis honnête (2026)

Claude Fable 5 : guide complet et avis honnête (2026)

Anthropic a passé des mois à avertir que ses modèles les plus performants devenaient trop dangereux pour être commercialisés à grande échelle. Puis, le 9 juin 2026, l'entreprise en a tout de même lancé un — enfin, en quelque sorte. Claude Fable 5 est le premier modèle de la catégorie supérieure « Mythos » d'Anthropic que le public peut réellement appeler, et il se situe un niveau entier au-dessus de la famille Opus. Le piège est inhabituel : pour une partie des questions sensibles, la version pour laquelle vous payez transmet discrètement votre demande à un modèle différent et moins puissant, qui fournit ensuite la réponse. Cette seule décision de conception en dit long sur ce qui rend Fable 5 différent ; c'est donc par là que commence ce guide. Voici un guide pratique pour les développeurs, pas un résumé du lancement. Nous avons compilé les spécifications et le comportement du modèle à partir de la documentation d'Anthropic, de benchmarks indépendants et des premiers tests pratiques publiés depuis le lancement — et nous avons exclu les chiffres que nous n'avons pas pu vérifier.

Schuyler Stacy | 2026-06-11

Qu'est-ce que GLM 5.2 ? Le codage à poids ouverts à 1/6 du prix

Qu'est-ce que GLM 5.2 ? Le codage à poids ouverts à 1/6 du prix

Un laboratoire chinois a lancé un modèle que vous pouvez télécharger gratuitement, exécuter sur votre propre matériel et obtenir pour environ un sixième du prix des modèles de pointe fermés — tout en restant à quelques points derrière Claude Opus 4.8 sur de véritables benchmarks de codage. Puis il a commercialisé ce modèle sans publier le moindre benchmark officiel. Voilà ce qu'est GLM 5.2, et l'écart entre « aucun chiffre marketing » et « presque au sommet de tous les classements indépendants en une semaine » est précisément ce qui le rend intéressant à comprendre. J'écris beaucoup de ces articles explicatifs, et la plupart des publications consacrées aux nouveaux modèles sont vite oubliées, car elles se contentent de reformuler une fiche technique. Celui-ci se distingue sur un axe qui compte réellement pour les développeurs : les poids sont ouverts sous licence MIT. La question habituelle — « le benchmark est-il réel ou s'agit-il de marketing ? » — admet donc une réponse inhabituellement claire. Des utilisateurs l'ont téléchargé et testé eux-mêmes. Voici ce qu'est GLM 5.2, comment il fonctionne et quelles sont ses limites.

Michael Johnson | 2026-07-15

API Doubao : le guide complet (2026) — Quel modèle appeler et comment

API Doubao : le guide complet (2026) — Quel modèle appeler et comment

Recherchez « API Doubao » et vous vous heurtez rapidement à un mur. La console officielle est Volcano Engine, les pages sont configurées par défaut en chinois et l’inscription demande une vérification d’identité que la plupart des développeurs hors de Chine ne peuvent pas effectuer en un après-midi. S’ajoute ensuite la question des noms : Doubao, Dola, Cici, Seed, Seedream, Seedance, Volcengine — tous appartiennent à ByteDance, et aucun ne correspond clairement à ce que vous avez saisi dans le champ de recherche. J’écris des guides d’intégration pour GPTProto, et Doubao est la famille de modèles dont on me parle le plus. Voici donc le guide que j’aurais aimé trouver : quel modèle Doubao convient à chaque tâche, combien coûte réellement chacun et comment les appeler avec du code prêt à copier-coller — texte, image et vidéo — depuis un seul endpoint, sans numéro de téléphone chinois. Voici une séquence produite par le modèle vidéo Seedance 2.0 à partir d’une invite textuelle, appelée via l’API exactement comme dans le code présenté plus bas. Commençons par le début.

Schuyler Stacy | 2026-06-23