Qu'est-ce que Claude Sonnet 5 ?
Sonnet 5 est le nouveau modèle intermédiaire d'Anthropic, présenté comme son Sonnet le plus agentique à ce jour : il planifie, pilote des navigateurs et des terminaux, et exécute seul des tâches en plusieurs étapes. L'angle privilégié par Anthropic est celui du rapport coût-performances — des performances proches d'Opus 4.8, au tarif de Sonnet.
Cette présentation est importante avant d'aborder les aspects pratiques : pendant la majeure partie de l'année dernière, les progrès agentiques les plus significatifs ont été réalisés dans la gamme Opus, et non Sonnet. Les équipes qui exécutaient des tâches agentiques à grande échelle devaient donc payer les tarifs d'Opus pour des capacités dont elles n'avaient besoin qu'une partie du temps. Sonnet 5 est la tentative d'Anthropic de faire descendre une partie de ces capacités dans une gamme tarifaire inférieure. Voilà le « pourquoi », et cela explique la plupart des choix de conception qui suivent.
D'après la documentation d'Anthropic, voici les aspects pratiques : il s'agit d'un remplacement direct de Sonnet 4.6, il utilise l'identifiant de modèle API claude-sonnet-5, propose une fenêtre de contexte d'un million de tokens par défaut et au maximum, et prend en charge jusqu'à 128 000 tokens en sortie. Texte et images en entrée, texte en sortie.
| |
Claude Sonnet 5 |
| Date de sortie |
30 juin 2026 |
| Identifiant de modèle API |
claude-sonnet-5 |
| Fenêtre de contexte |
1 million de tokens (par défaut et maximum) |
| Sortie maximale |
128 000 tokens |
| Entrée / sortie |
Texte + image en entrée, texte en sortie |
| Relation avec 4.6 |
Remplacement direct |
Quoi de neuf par rapport à Sonnet 4.6 ?
Si vous utilisez déjà Sonnet 4.6, la mise à niveau ne consiste pas seulement en une évolution des poids. Selon la documentation d'Anthropic, trois changements de comportement affecteront votre code :
- La réflexion adaptative est activée par défaut.
- La réflexion étendue manuelle renvoie désormais une erreur 400 (elle était déjà obsolète dans 4.6).
- Définir des paramètres d'échantillonnage — temperature, top_p, top_k — sur des valeurs non définies par défaut renvoie une erreur 400.
Deux autres changements ont une importance opérationnelle. Sonnet 5 propose des niveaux d'effort (low, medium, high et xhigh) : plus l'effort est élevé, plus de tokens sont consacrés au raisonnement afin d'obtenir une meilleure qualité — et un coût supérieur. C'est également le premier modèle de la gamme Sonnet à intégrer par défaut de véritables protections cyber en temps réel. Ces protections ont une particularité à connaître avant de l'intégrer à un agent : lorsque le modèle refuse une requête signalée, le refus revient sous la forme d'une réponse HTTP 200 réussie avec stop_reason: "refusal", et non sous la forme d'une erreur. Si votre gestion des erreurs suppose qu'un refus déclenche une exception, ce ne sera pas le cas.
Le changement qui aura toutefois le plus grand impact est celui que personne ne met dans les titres : le tokenizer. Je lui consacre une section, car il modifie le calcul des coûts.
Fonctionnalités et performances
Anthropic présente Sonnet 5 comme une amélioration nette par rapport à 4.6 en matière de raisonnement, d'utilisation d'outils, de programmation et de travail de connaissance, et comme suffisamment proche d'Opus 4.8 pour vous permettre de choisir votre position sur la courbe coût-performances grâce à la molette d'effort. Les chiffres précis des benchmarks ci-dessous proviennent des documents de lancement d'Anthropic et de la couverture du premier jour ; considérez-les comme rapportés par Anthropic jusqu'à ce que vous les ayez lus vous-même dans le System Card.
| Benchmark |
Sonnet 5 |
Sonnet 4.6 |
Opus 4.8 |
| SWE-bench Pro (programmation agentique) |
63.2% |
58.1% |
69.2% |
| OSWorld-Verified (utilisation d'ordinateur) |
81.2% |
78.5% |
— |
| Terminal-Bench 2.1 |
80.4% |
67.0% |
— |
| Humanity's Last Exam (avec outils) |
57.4% |
46.8% |
57.9% |
| GDPval-AA v2 (travail de connaissance) |
1,618 |
— |
1,615 |
Chiffres tels que rapportés lors du lancement d'Anthropic le 30 juin 2026 ; les tirets correspondent aux cellules que je n'ai pas pu confirmer.
Lisez honnêtement ce tableau et deux éléments ressortent. En programmation, Sonnet 5 dépasse 4.6 avec une marge réelle, mais reste en dessous d' Opus 4.8 — l'écart se réduit, mais ne disparaît pas. En matière de travail de connaissance, il devance Opus 4.8 d'un cheveu (1 618 contre 1 615), ce qui explique l'affirmation « bat parfois Opus » que vous verrez répétée partout ; elle est vraie, mais de très peu, sur un seul benchmark.
Voici ce que le florilège de points forts ne dit pas sur le coût. Les propres graphiques d'Anthropic montrent que le meilleur rapport qualité-prix de Sonnet 5 se situe avec un effort faible ou moyen. Passez à xhigh, et les articles publiés le jour du lancement indiquent que le coût peut dépasser celui d'Opus 4.8 pour une qualité similaire. Ainsi, « moins cher qu'Opus » doit être assorti d'un astérisque : moins cher aux niveaux d'effort auxquels on choisirait réellement Sonnet, pas nécessairement lorsqu'on le pousse au maximum. Mon avis : si une tâche a réellement besoin d'un raisonnement xhigh, comparez le prix avec Opus 4.8 avant de choisir Sonnet 5 par défaut — l'intuition selon laquelle le modèle plus petit est toujours moins cher ne tient plus au sommet de la molette.
En matière de sécurité, Anthropic rapporte des taux plus faibles d'hallucinations, de complaisance et de comportements indésirables qu'avec 4.6, ainsi qu'une meilleure résistance aux requêtes malveillantes et aux détournements par injection de prompt. La réserve qu'ils publient eux-mêmes : Sonnet 5 présente encore un taux de comportements mal alignés supérieur à celui d'Opus 4.8 lors de leur audit interne. Quant à la cybersécurité, il n'a jamais produit d'exploit complet et fonctionnel pendant les tests — une capacité volontairement faible dans ce domaine, ce qui est un avantage si vous déployez un agent destiné aux clients et une limite si votre cas d'usage concerne des travaux de sécurité autorisés.
Tarification de Claude Sonnet 5 : est-il vraiment moins cher ?
Les tarifs affichés — directement auprès d'Anthropic, ainsi que les tarifs actuels de GPT Proto :
| |
Entrée / 1 million |
Sortie / 1 million |
| Sonnet 5 — lancement (jusqu'au 31 août 2026) |
$2 |
$10 |
| Sonnet 5 — standard (à partir du 1er septembre 2026) |
$3 |
$15 |
| Sonnet 5 — via GPT Proto (actuel) |
$1.6 |
$8 |
| Sonnet 4.6 |
$3 |
$15 |
| Opus 4.8 |
$5 |
$25 |
Au tarif standard, Sonnet 5 coûte le même prix par token que 4.6 et reste nettement moins cher qu'Opus 4.8. Simple. Sauf que le prix par token ne représente pas toute la facture.
Sonnet 5 utilise un nouveau tokenizer — le même qu'Anthropic a introduit avec Opus 4.7 — et le même texte correspond désormais à environ 1,0 à 1,35 fois plus de tokens selon le type de contenu. Anthropic l'indique clairement dans une note de bas de page, ainsi que la conséquence : le tarif de lancement est fixé de manière à ce que le passage depuis 4.6 soit à peu près neutre en termes de coût pendant la période de lancement. Lisez attentivement. Cela signifie que le tarif de lancement de 2 $/10 $ n'est pas une pure remise ; une partie compense les tokens supplémentaires. Et cela signifie qu'au 1er septembre, lorsque le prix reviendra à 3 $/15 $ — identique à celui de 4.6 sur le papier — une requête équivalente pourra vous coûter plus cher qu'avec 4.6, car davantage de tokens seront facturés pour le même texte.
Alors, Sonnet 5 est-il moins cher que 4.6 ? La réponse honnête est : cela dépend de la date et de l'intensité d'utilisation. Jusqu'à fin août, effectivement oui. Ensuite, pour la même charge de travail, prévoyez un coût par requête stable ou légèrement supérieur, et non inférieur — mesurez vos propres prompts avec le nouveau tokenizer au lieu de vous fier à la ligne du prix par token.
Si vous appelez Claude via GPT Proto plutôt que directement, Sonnet 5 est disponible sur la plateforme au tarif de 1,6 $ / million de tokens en entrée et 8 $ / million en sortie — 20 % de moins que le tarif de lancement d'Anthropic de 2 $/10 $, ce qui en fait l'option la moins chère pendant la durée de cette offre. À titre de comparaison, sur la même plateforme, Sonnet 4.6 coûte 2,4 $/12 $ et Opus 4.8 4 $/20 $. Les appels exécutables de la section suivante ciblent directement Sonnet 5.
Comment utiliser Claude Sonnet 5 via l'API
Sonnet 5 est désormais disponible sur GPT Proto ; les exemples exécutables ci-dessous l'appellent directement depuis la page du modèle Claude Sonnet 5. Si vous migrez depuis 4.6, il s'agit du remplacement direct annoncé par Anthropic : remplacez claude-sonnet-4-6 par claude-sonnet-5 et ne modifiez rien d'autre dans l'appel.
GPT Proto expose Claude au format Messages natif d'Anthropic à l'adresse https://gptproto.com/v1/messages, avec un token Bearer. Commençons par cURL :
curl --request POST "https://gptproto.com/v1/messages" \
--header "Authorization: Bearer $GPTPROTO_API_KEY" \
--header "Content-Type: application/json" \
--header "anthropic-version: 2023-06-01" \
--data '{
"model": "claude-sonnet-5",
"max_tokens": 1024,
"messages": [
{ "role": "user", "content": "Explain what an agentic coding model does in two sentences." }
]
}'
Le même appel en Python, en utilisant uniquement requests :
import os
import requests
resp = requests.post(
"https://gptproto.com/v1/messages",
headers={
"Authorization": f"Bearer {os.environ['GPTPROTO_API_KEY']}",
"Content-Type": "application/json",
"anthropic-version": "2023-06-01",
},
json={
"model": "claude-sonnet-5",
"max_tokens": 1024,
"messages": [
{"role": "user", "content": "Explain what an agentic coding model does in two sentences."}
],
},
timeout=60,
)
resp.raise_for_status()
data = resp.json()
print(data["content"][0]["text"])
Deux éléments à retenir lors de votre migration vers Sonnet 5. Premièrement, le changement de tokenizer signifie que le nombre de tokens — et donc votre facture ainsi que la marge disponible pour max_tokens — évolue même si le texte ne change pas ; remesurez avant de supposer que vos limites actuelles sont toujours suffisantes. Deuxièmement, si votre code actuel définit temperature, top_p ou top_k sur des valeurs personnalisées, ou active la réflexion étendue manuelle, supprimez ces paramètres : avec Sonnet 5, ils renvoient une erreur 400.
Une seule clé GPT Proto vous donne accès à Claude et à plus de 200 autres modèles avec un solde unique. Vous pouvez ainsi comparer Sonnet 5 à un modèle moins cher sur le même chemin de requête, sans jongler entre les fournisseurs. La liste complète se trouve dans le catalogue des modèles.
Sonnet 5 contre Sonnet 4.6 (et si vous utilisez encore 4.5 ou 3.5)
Voici la comparaison directe que j'utiliserais réellement pour décider, en conservant Opus 4.8 comme plafond de référence :
| |
Sonnet 5 |
Sonnet 4.6 |
Opus 4.8 |
| Positionnement |
Travail agentique proche d'Opus au tarif de Sonnet |
Référence précédente du milieu de gamme |
Plafond de précision |
| Programmation (SWE-bench Pro) |
63.2% |
58.1% |
69.2% |
| Meilleur rapport qualité-prix avec |
Effort faible / moyen |
— |
Tâches les plus difficiles |
| Tarif standard (entrée/sortie par million) |
$3 / $15 |
$3 / $15 |
$5 / $25 |
| Contexte |
1 million |
jusqu'à 1 million |
200 000 |
| Réserve concernant le coût |
Le nouveau tokenizer facture davantage de tokens ; xhigh peut dépasser le coût d'Opus |
Tokenizer familier |
Tarif adapté au haut de gamme |
Mon analyse : si vous utilisez 4.6 et effectuez un travail agentique ou de programmation soutenu, Sonnet 5 est la mise à niveau à essayer — les gains en programmation et en utilisation d'outils sont réels, et le tarif de lancement rend l'essai peu coûteux. Si votre charge de travail exige une précision maximale — le genre de tâche où une mauvaise réponse coûte cher — gardez Opus 4.8 dans la boucle et réservez Sonnet 5 au volume intermédiaire. Et si vous utilisez constamment l'effort xhigh, c'est le signe qu'il faut chiffrer Opus 4.8, pas supposer que Sonnet est moins cher.
Vous utilisez encore Sonnet 4.5 ou 3.5 ? Le dossier en faveur de la mise à niveau est alors encore plus solide, mais je m'abstiendrais de vous citer un benchmark propre « 5 contre 3.5 », car Anthropic n'en a pas publié ; tous les chiffres de comparaison ci-dessus concernent 4.6. Ce que je peux dire, c'est que la tendance est claire : deux générations de progrès agentiques séparent 3.5 et 5, notamment en matière d'utilisation d'outils et de fiabilité sur les tâches longues, domaines où les anciens Sonnet atteignaient leurs limites. Quelle que soit votre version de départ, la démarche pratique est la même : dirigez votre code vers Sonnet 5 sur GPT Proto et laissez la molette d'effort faire le reste.
Est-ce que cela en vaut la peine ? Une analyse honnête
L'accueil du premier jour a été partagé, et cette division est instructive. Les éloges se concentraient sur le rapport qualité-prix au tarif de lancement. Les doutes portaient sur la même question autour de laquelle ce guide revient sans cesse : le modèle tient-il ses promesses lorsque le tarif standard de 3 $/15 $ revient et que l'inflation des tokens due au tokenizer fait discrètement son travail ?
Le signal le plus utile que j'ai vu n'était pas un benchmark, mais un test pratique réalisé par une équipe spécialisée dans les outils de revue de code, qui l'a utilisé sur du travail réel. Leur conclusion va dans les deux sens, ce qui la rend crédible : pour écrire et construire du code, Sonnet 5 était le modèle le plus performant qu'ils aient utilisé dans cette gamme. Pour la revue de code, c'était un compromis : des commentaires plus clairs et plus précis, mais moins de bugs détectés que par les modèles déjà utilisés en production, pour un coût légèrement supérieur par revue. Ils ont également relevé deux habitudes qui se traduisent par des gains de productivité dans les boucles agentiques : il a tendance à écrire les tests avant la fonctionnalité et réécrit son propre plan au milieu d'une tâche longue au lieu de suivre aveuglément un plan devenu obsolète. La réserve qu'ils ont signalée rejoint la note d'Anthropic : les nouvelles protections cyber déclencheront parfois un refus sur des travaux de sécurité légitimes.
À retenir : les citations élogieuses de l'annonce proviennent de partenaires ayant bénéficié d'un accès anticipé. Elles sont authentiques, mais sélectionnées, et les témoignages choisis par un fournisseur ne constituent pas une preuve neutre. Le retour indépendant issu d'une expérience pratique — très performant pour la génération, moins bon et plus cher pour la revue — constitue une base plus honnête.
Alors, qui devrait passer à Sonnet 5 ? Les équipes qui font beaucoup de programmation, utilisent des outils, automatisent des navigateurs et des terminaux, ou réalisent un travail de connaissance pour lequel elles payaient trop cher Opus — passez-y, et faites-le pendant la période de lancement, tant que l'essai est peu coûteux. Les équipes dont le processus principal repose sur des revues minutieuses ou des décisions exigeant une grande précision — testez-le, mais ne retirez pas votre modèle actuel dès le jour du lancement et relancez votre propre suite d'évaluations avant de vous engager.
En résumé : Sonnet 5 constitue une véritable avancée pour le travail agentique et la programmation, et le tarif de lancement le rend peu coûteux à essayer. Mais ne traduisez pas « même tarif catalogue que 4.6 » par « même facture », et comparez le prix d'Opus 4.8 avant de pousser la molette d'effort au maximum. Vous pouvez appeler Claude Sonnet 5 sur GPT Proto dès aujourd'hui au tarif de 1,6 $ / 8 $ — 20 % sous le tarif de lancement d'Anthropic — avec un solde et une clé API uniques, parmi plus de 200 modèles si vous souhaitez rediriger les appels sensibles au coût vers d'autres modèles.