O que é o Claude Sonnet 5?
O Sonnet 5 é o mais novo modelo intermediário da Anthropic, apresentado como seu Sonnet mais agêntico até agora: ele planeja, controla navegadores e terminais e executa tarefas de várias etapas por conta própria. A ideia principal destacada pela Anthropic é uma relação custo-desempenho — desempenho próximo ao Opus 4.8, pelo preço do Sonnet.
Por que esse enquadramento importa antes de chegarmos à parte mecânica: durante a maior parte do último ano, os maiores avanços em recursos agênticos aconteceram no nível Opus, não no Sonnet. Assim, as equipes que executavam trabalhos agênticos em alto volume ficavam presas a pagar preços de Opus por uma capacidade de que precisavam apenas parte do tempo. O Sonnet 5 é a tentativa da Anthropic de trazer uma parte dessa capacidade para um nível de preço inferior. Esse é o "porquê" e explica a maioria das escolhas de design que vêm a seguir.
A parte mecânica, segundo a documentação da Anthropic: ele é um substituto direto do Sonnet 4.6, usa o ID de modelo da API claude-sonnet-5, vem com uma janela de contexto de 1 milhão de tokens como padrão e máximo e aceita até 128 mil tokens de saída. Recebe texto e imagem e produz texto.
| |
Claude Sonnet 5 |
| Lançamento |
30 de junho de 2026 |
| ID de modelo da API |
claude-sonnet-5 |
| Janela de contexto |
1 milhão de tokens (padrão e máximo) |
| Saída máxima |
128 mil tokens |
| Entrada / saída |
Texto + imagem na entrada, texto na saída |
| Relação com o 4.6 |
Substituto direto |
O que há de novo em relação ao Sonnet 4.6
Se você já executa o Sonnet 4.6, a atualização não é apenas um aumento de pesos. Segundo a documentação da Anthropic, três mudanças de comportamento afetarão seu código:
- O pensamento adaptativo vem ativado por padrão.
- O pensamento estendido manual agora retorna um erro 400 (ele já estava obsoleto no 4.6).
- Definir parâmetros de amostragem — temperature, top_p, top_k — com valores diferentes dos padrão retorna um erro 400.
Duas outras mudanças são importantes operacionalmente. O Sonnet 5 oferece níveis de esforço (baixo, médio, alto e xhigh), nos quais um esforço maior usa mais tokens para raciocínio em troca de mais qualidade — e mais custo. Além disso, ele é o primeiro modelo da categoria Sonnet com proteções cibernéticas em tempo real ativadas por padrão. Essas proteções têm uma particularidade que vale conhecer antes de integrá-las a um agente: quando o modelo recusa uma solicitação sinalizada, a recusa retorna como um HTTP 200 bem-sucedido com stop_reason: "refusal", e não como um erro. Se o seu tratamento de erros pressupõe que uma recusa gera uma exceção, ele não funcionará.
A mudança com o maior impacto, porém, é algo que ninguém coloca no título: o tokenizador. Estou dedicando uma seção própria a ele porque muda a matemática dos preços.
Principais recursos e desempenho
A Anthropic posiciona o Sonnet 5 como uma melhoria rigorosa em relação ao 4.6 em raciocínio, uso de ferramentas, programação e trabalho de conhecimento, e como um modelo próximo o suficiente do Opus 4.8 para que você possa escolher seu ponto na curva de custo-desempenho usando o controle de esforço. Os números específicos de benchmark abaixo foram divulgados nos materiais de lançamento da Anthropic e na cobertura do primeiro dia; trate os números exatos como dados reportados pela Anthropic até que você mesmo leia o System Card.
| Benchmark |
Sonnet 5 |
Sonnet 4.6 |
Opus 4.8 |
| SWE-bench Pro (programação agêntica) |
63.2% |
58.1% |
69.2% |
| OSWorld-Verified (uso de computador) |
81.2% |
78.5% |
— |
| Terminal-Bench 2.1 |
80.4% |
67.0% |
— |
| Humanity's Last Exam (com ferramentas) |
57.4% |
46.8% |
57.9% |
| GDPval-AA v2 (trabalho de conhecimento) |
1,618 |
— |
1,615 |
Números divulgados no lançamento da Anthropic em 30 de junho de 2026; os travessões representam células que não consegui confirmar.
Leia essa tabela com honestidade e duas coisas se destacam. Em programação, o Sonnet 5 supera o 4.6 por uma margem real, mas ainda fica abaixo do Opus 4.8 — ele reduz a diferença, mas não a elimina. Em trabalho de conhecimento, supera o Opus 4.8 por pouco (1,618 contra 1,615), que é a origem da frase "às vezes supera o Opus" repetida em toda parte; é verdade, mas é uma diferença mínima, em um benchmark.
Eis o custo que o resumo dos destaques deixa de fora. Os próprios gráficos da Anthropic mostram que o melhor valor do Sonnet 5 está nos níveis de esforço baixo e médio. Leve-o para xhigh, e as reportagens do dia do lançamento dizem que o custo pode ultrapassar o do Opus 4.8 para uma qualidade semelhante. Portanto, "mais barato que o Opus" é uma afirmação com ressalvas: mais barato nos níveis de esforço em que você realmente recorreria a um Sonnet, não necessariamente quando o leva ao máximo. Minha opinião: se uma tarefa realmente precisa de raciocínio xhigh, calcule o preço do Opus 4.8 antes de escolher o Sonnet 5 por padrão — a intuição de que o modelo menor é sempre a opção mais barata deixa de funcionar no topo do controle.
Em segurança, a Anthropic relata taxas menores de alucinação, comportamento bajulador e comportamento indesejável do que no 4.6, além de maior resistência a solicitações maliciosas e sequestros por injeção de prompt. A ressalva publicada pela própria empresa: o Sonnet 5 ainda apresenta uma taxa maior de comportamento desalinhado do que o Opus 4.8 em sua auditoria interna. E, no aspecto cibernético, ele nunca produziu um exploit completo e funcional nos testes — uma capacidade deliberadamente baixa, o que é uma vantagem se você estiver lançando um agente voltado ao cliente e uma limitação se segurança autorizada for seu caso de uso.
Preços do Claude Sonnet 5: ele é realmente mais barato?
Os preços de tabela — diretamente com a Anthropic, além da tarifa atual do GPT Proto:
| |
Entrada / 1 milhão |
Saída / 1 milhão |
| Sonnet 5 — introdutório (até 31 de agosto de 2026) |
$2 |
$10 |
| Sonnet 5 — padrão (a partir de 1º de setembro de 2026) |
$3 |
$15 |
| Sonnet 5 — via GPT Proto (atual) |
$1.6 |
$8 |
| Sonnet 4.6 |
$3 |
$15 |
| Opus 4.8 |
$5 |
$25 |
No preço padrão, o Sonnet 5 custa o mesmo por token que o 4.6 e fica bem abaixo do Opus 4.8. Simples. Exceto que o preço por token não representa a conta inteira.
O Sonnet 5 vem com um novo tokenizador — o mesmo que a Anthropic introduziu com o Opus 4.7 — e o mesmo texto agora corresponde a cerca de 1,0 a 1,35× mais tokens, dependendo do tipo de conteúdo. A Anthropic é transparente sobre isso em uma nota de rodapé e sobre a consequência: o preço introdutório foi definido para que a migração do 4.6 seja aproximadamente neutra em custo durante a janela introdutória. Leia isso com atenção. Significa que o preço de lançamento de $2/$10 não é um desconto puro; parte dele compensa os tokens extras. E significa que, em 1º de setembro, quando o preço voltar a $3/$15 — idêntico ao do 4.6 no papel — uma solicitação equivalente poderá custar mais do que custava no 4.6, porque serão cobrados mais tokens pelo mesmo texto.
Então, o Sonnet 5 é mais barato que o 4.6? A resposta honesta é: depende de quando e com que intensidade você o executa. Até agosto, efetivamente sim. Depois disso, para a mesma carga de trabalho, planeje um custo por solicitação estável ou moderadamente maior, não menor — e meça seus próprios prompts com o novo tokenizador em vez de confiar na linha de preço por token.
Se você chama o Claude pelo GPT Proto em vez de diretamente, o Sonnet 5 está disponível na plataforma por $1.6 / 1 milhão de tokens de entrada e $8 / 1 milhão de tokens de saída — 20% abaixo da tarifa introdutória de $2/$10 da Anthropic, o que o torna o caminho mais barato enquanto durar o preço de lançamento. Como referência, na mesma plataforma, o Sonnet 4.6 custa $2.4/$12 e o Opus 4.8 custa $4/$20. As chamadas executáveis na próxima seção apontam diretamente para o Sonnet 5.
Como usar o Claude Sonnet 5 pela API
O Sonnet 5 já está disponível no GPT Proto, portanto os exemplos executáveis abaixo o chamam diretamente na página do modelo Claude Sonnet 5. Se você estiver migrando do 4.6, esta é a substituição direta anunciada pela Anthropic — troque claude-sonnet-4-6 por claude-sonnet-5 e mantenha o restante da chamada inalterado.
O GPT Proto disponibiliza o Claude no formato nativo Messages da Anthropic em https://gptproto.com/v1/messages, com um token Bearer. Primeiro, cURL:
curl --request POST "https://gptproto.com/v1/messages" \
--header "Authorization: Bearer $GPTPROTO_API_KEY" \
--header "Content-Type: application/json" \
--header "anthropic-version: 2023-06-01" \
--data '{
"model": "claude-sonnet-5",
"max_tokens": 1024,
"messages": [
{ "role": "user", "content": "Explain what an agentic coding model does in two sentences." }
]
}'
A mesma chamada em Python, usando apenas requests:
import os
import requests
resp = requests.post(
"https://gptproto.com/v1/messages",
headers={
"Authorization": f"Bearer {os.environ['GPTPROTO_API_KEY']}",
"Content-Type": "application/json",
"anthropic-version": "2023-06-01",
},
json={
"model": "claude-sonnet-5",
"max_tokens": 1024,
"messages": [
{"role": "user", "content": "Explain what an agentic coding model does in two sentences."}
],
},
timeout=60,
)
resp.raise_for_status()
data = resp.json()
print(data["content"][0]["text"])
Ao migrar para o Sonnet 5, leve duas coisas em consideração. Primeiro, a mudança no tokenizador significa que suas contagens de tokens — e, portanto, sua conta e a margem de max_tokens— mudam mesmo que o texto não mude; faça uma nova medição antes de presumir que seus limites atuais continuam adequados. Segundo, se algum código atual definir temperature, top_p ou top_k com valores personalizados, ou ativar o pensamento estendido manual, remova essas configurações: no Sonnet 5, elas retornam um erro 400.
Uma única chave no GPT Proto dá acesso ao Claude e a mais de 200 outros modelos usando um único saldo, para que você possa comparar o Sonnet 5 com, por exemplo, um modelo mais barato no mesmo caminho de solicitação, sem administrar vários provedores. A lista completa está no catálogo de modelos.
Sonnet 5 vs Sonnet 4.6 (e se você ainda estiver no 4.5 ou 3.5)
Esta é a comparação direta que eu usaria para decidir, mantendo o Opus 4.8 como referência do teto de capacidade:
| |
Sonnet 5 |
Sonnet 4.6 |
Opus 4.8 |
| Posicionamento |
Trabalho agêntico próximo ao Opus pelo preço do Sonnet |
Padrão intermediário anterior |
Teto de precisão |
| Programação (SWE-bench Pro) |
63.2% |
58.1% |
69.2% |
| Melhor valor em |
Esforço baixo / médio |
— |
Tarefas mais difíceis |
| Preço padrão (entrada/saída por 1 milhão) |
$3 / $15 |
$3 / $15 |
$5 / $25 |
| Contexto |
1 milhão |
até 1 milhão |
200 mil |
| Ressalva de custo |
O novo tokenizador cobra mais tokens; xhigh pode superar o custo do Opus |
Tokenizador familiar |
Preço pensado para o nível máximo |
Minha leitura: se você está no 4.6 e executa trabalhos agênticos ou de programação de forma contínua, o Sonnet 5 é a atualização que vale testar — os ganhos em programação e uso de ferramentas são reais, e o preço introdutório torna o teste barato. Se sua carga de trabalho exige precisão no nível máximo — o tipo de tarefa em que uma resposta errada é cara — mantenha o Opus 4.8 no circuito e reserve o Sonnet 5 para o volume intermediário. E, se você utiliza constantemente o esforço xhigh, isso é um sinal para calcular o preço do Opus 4.8, não um motivo para presumir que o Sonnet é mais barato.
Ainda está no Sonnet 4.5 ou 3.5? Então o caso para atualizar é ainda mais forte, mas eu evitaria citar um benchmark limpo de "5 contra 3.5", porque a Anthropic não publicou um — todos os números de comparações diretas acima são contra o 4.6. O que posso dizer é uma indicação direcional: há duas gerações de avanços agênticos entre o 3.5 e o 5, a maioria exatamente no uso de ferramentas e na confiabilidade em tarefas longas, áreas em que os Sonnets mais antigos ficavam aquém. A medida prática é a mesma, independentemente do ponto de partida: aponte seu código para o Sonnet 5 no GPT Proto e deixe o controle de esforço cuidar do restante.
Vale a pena? Uma análise honesta
A recepção no primeiro dia foi dividida, e essa divisão é reveladora. Os elogios se concentraram na relação preço-valor da tarifa introdutória. As dúvidas se concentraram na mesma questão que este guia continua examinando: se o modelo se sustenta quando o preço padrão de $3/$15 retornar e a inflação de tokens do tokenizador começar a pesar silenciosamente.
O sinal mais útil que vi não foi um benchmark — foi uma análise prática de uma equipe de ferramentas de revisão de código que o executou em trabalho real. A conclusão tem dois lados, e é por isso que confio nela: para escrever e criar código, o Sonnet 5 foi o modelo mais forte que eles haviam usado nessa categoria. Para revisar código, houve um compromisso — comentários mais limpos e precisos, mas menos bugs detectados do que pelos modelos que já executam em produção, a um custo por revisão ligeiramente maior. Eles também perceberam dois hábitos que aparecem como produtividade nos ciclos de agentes: o modelo tende a escrever testes antes do recurso e reescreve o próprio plano no meio de uma tarefa longa, em vez de seguir cegamente um plano obsoleto. A ressalva apontada por eles coincide com a própria observação da Anthropic — as novas proteções cibernéticas ocasionalmente são acionadas por trabalhos legítimos de segurança.
Vale lembrar: as citações entusiasmadas na publicação de lançamento vêm de parceiros de acesso antecipado da Anthropic. Elas são reais, mas foram selecionadas, e um fornecedor escolher seus próprios depoimentos não constitui evidência neutra. A análise prática independente — forte na geração, mais fraca e mais cara na revisão — é a referência inicial mais honesta.
Então, quem deve migrar? Equipes que fazem programação em alto volume, usam ferramentas, automatizam navegadores e terminais ou executam trabalho de conhecimento pelo qual estavam pagando demais pelo Opus — migrem, e façam isso durante a janela introdutória, enquanto o teste estiver barato. Equipes cujo ciclo principal envolve revisão cuidadosa ou decisões críticas para a precisão — testem, mas não aposentem o modelo atual no dia do lançamento e executem novamente sua própria suíte de avaliações antes de se comprometerem.
Em resumo: o Sonnet 5 é um avanço real para trabalhos agênticos e de programação, e o preço introdutório torna barato experimentá-lo — apenas não interprete "mesmo preço de lista do 4.6" como "mesma conta" e calcule o preço do Opus 4.8 antes de aumentar o controle de esforço. Hoje, você pode chamar o Claude Sonnet 5 no GPT Proto por $1.6 / $8 — 20% abaixo da tarifa de lançamento da Anthropic — usando um único saldo e uma única chave de API, com acesso a mais de 200 modelos caso queira direcionar chamadas sensíveis a custo para outro modelo.