Preços+7% bônus
Schuyler Stacy2026-07-01

Claude Sonnet 5: O Que Há de Novo, Quanto Custa e Como se Compara ao Sonnet 4.6 (Guia de 2026)

Guia do Claude Sonnet 5: o que há de novo em relação ao Sonnet 4.6, benchmarks, preços de $2/$10, a particularidade do tokenizador que altera sua conta e código de API executável.

Claude Sonnet 5: O Que Há de Novo, Quanto Custa e Como se Compara ao Sonnet 4.6 (Guia de 2026)

A Anthropic lançou o Claude Sonnet 5 em 30 de junho de 2026 e, em menos de uma hora, meus feeds estavam cheios das mesmas duas perguntas: devo deixar o Sonnet 4.6 e a afirmação de que ele tem o "mesmo preço de lista do 4.6" é realmente verdadeira quando você coloca tráfego real para rodar? Essas também são as perguntas que me interessam, então este guia foi construído em torno delas, e não do resumo dos destaques da publicação de lançamento. Tudo o que é técnico aqui vem da própria publicação de lançamento e da documentação da Anthropic; quando um número vem de reportagens, e não de uma página que eu pude consultar diretamente, eu aviso.

Uma observação inicial, porque muitos textos publicados no começo entendem isso errado: o antecessor do Sonnet 5 é o Sonnet 4.6 (lançado em fevereiro de 2026), não o Sonnet 4.5. Se você estiver comparando com o 4.5 ou com um 3.5 ainda mais antigo, estará comparando duas atualizações, e os números abaixo não vão coincidir. Voltarei a esse ponto.

Índice

O que é o Claude Sonnet 5?

O Sonnet 5 é o mais novo modelo intermediário da Anthropic, apresentado como seu Sonnet mais agêntico até agora: ele planeja, controla navegadores e terminais e executa tarefas de várias etapas por conta própria. A ideia principal destacada pela Anthropic é uma relação custo-desempenho — desempenho próximo ao Opus 4.8, pelo preço do Sonnet.

Por que esse enquadramento importa antes de chegarmos à parte mecânica: durante a maior parte do último ano, os maiores avanços em recursos agênticos aconteceram no nível Opus, não no Sonnet. Assim, as equipes que executavam trabalhos agênticos em alto volume ficavam presas a pagar preços de Opus por uma capacidade de que precisavam apenas parte do tempo. O Sonnet 5 é a tentativa da Anthropic de trazer uma parte dessa capacidade para um nível de preço inferior. Esse é o "porquê" e explica a maioria das escolhas de design que vêm a seguir.

A parte mecânica, segundo a documentação da Anthropic: ele é um substituto direto do Sonnet 4.6, usa o ID de modelo da API claude-sonnet-5, vem com uma janela de contexto de 1 milhão de tokens como padrão e máximo e aceita até 128 mil tokens de saída. Recebe texto e imagem e produz texto.

  Claude Sonnet 5
Lançamento 30 de junho de 2026
ID de modelo da API claude-sonnet-5
Janela de contexto 1 milhão de tokens (padrão e máximo)
Saída máxima 128 mil tokens
Entrada / saída Texto + imagem na entrada, texto na saída
Relação com o 4.6 Substituto direto

O que há de novo em relação ao Sonnet 4.6

Se você já executa o Sonnet 4.6, a atualização não é apenas um aumento de pesos. Segundo a documentação da Anthropic, três mudanças de comportamento afetarão seu código:

  • O pensamento adaptativo vem ativado por padrão.
  • O pensamento estendido manual agora retorna um erro 400 (ele já estava obsoleto no 4.6).
  • Definir parâmetros de amostragem — temperature, top_p, top_k — com valores diferentes dos padrão retorna um erro 400.
    Duas outras mudanças são importantes operacionalmente. O Sonnet 5 oferece níveis de esforço (baixo, médio, alto e xhigh), nos quais um esforço maior usa mais tokens para raciocínio em troca de mais qualidade — e mais custo. Além disso, ele é o primeiro modelo da categoria Sonnet com proteções cibernéticas em tempo real ativadas por padrão. Essas proteções têm uma particularidade que vale conhecer antes de integrá-las a um agente: quando o modelo recusa uma solicitação sinalizada, a recusa retorna como um HTTP 200 bem-sucedido com stop_reason: "refusal", e não como um erro. Se o seu tratamento de erros pressupõe que uma recusa gera uma exceção, ele não funcionará.

A mudança com o maior impacto, porém, é algo que ninguém coloca no título: o tokenizador. Estou dedicando uma seção própria a ele porque muda a matemática dos preços.

Principais recursos e desempenho

A Anthropic posiciona o Sonnet 5 como uma melhoria rigorosa em relação ao 4.6 em raciocínio, uso de ferramentas, programação e trabalho de conhecimento, e como um modelo próximo o suficiente do Opus 4.8 para que você possa escolher seu ponto na curva de custo-desempenho usando o controle de esforço. Os números específicos de benchmark abaixo foram divulgados nos materiais de lançamento da Anthropic e na cobertura do primeiro dia; trate os números exatos como dados reportados pela Anthropic até que você mesmo leia o System Card.

Benchmark Sonnet 5 Sonnet 4.6 Opus 4.8
SWE-bench Pro (programação agêntica) 63.2% 58.1% 69.2%
OSWorld-Verified (uso de computador) 81.2% 78.5% —
Terminal-Bench 2.1 80.4% 67.0% —
Humanity's Last Exam (com ferramentas) 57.4% 46.8% 57.9%
GDPval-AA v2 (trabalho de conhecimento) 1,618 — 1,615

Números divulgados no lançamento da Anthropic em 30 de junho de 2026; os travessões representam células que não consegui confirmar.

Leia essa tabela com honestidade e duas coisas se destacam. Em programação, o Sonnet 5 supera o 4.6 por uma margem real, mas ainda fica abaixo do Opus 4.8  — ele reduz a diferença, mas não a elimina. Em trabalho de conhecimento, supera o Opus 4.8 por pouco (1,618 contra 1,615), que é a origem da frase "às vezes supera o Opus" repetida em toda parte; é verdade, mas é uma diferença mínima, em um benchmark.

Eis o custo que o resumo dos destaques deixa de fora. Os próprios gráficos da Anthropic mostram que o melhor valor do Sonnet 5 está nos níveis de esforço baixo e médio. Leve-o para xhigh, e as reportagens do dia do lançamento dizem que o custo pode ultrapassar o do Opus 4.8 para uma qualidade semelhante. Portanto, "mais barato que o Opus" é uma afirmação com ressalvas: mais barato nos níveis de esforço em que você realmente recorreria a um Sonnet, não necessariamente quando o leva ao máximo. Minha opinião: se uma tarefa realmente precisa de raciocínio xhigh, calcule o preço do Opus 4.8 antes de escolher o Sonnet 5 por padrão — a intuição de que o modelo menor é sempre a opção mais barata deixa de funcionar no topo do controle.

Em segurança, a Anthropic relata taxas menores de alucinação, comportamento bajulador e comportamento indesejável do que no 4.6, além de maior resistência a solicitações maliciosas e sequestros por injeção de prompt. A ressalva publicada pela própria empresa: o Sonnet 5 ainda apresenta uma taxa maior de comportamento desalinhado do que o Opus 4.8 em sua auditoria interna. E, no aspecto cibernético, ele nunca produziu um exploit completo e funcional nos testes — uma capacidade deliberadamente baixa, o que é uma vantagem se você estiver lançando um agente voltado ao cliente e uma limitação se segurança autorizada for seu caso de uso.

Preços do Claude Sonnet 5: ele é realmente mais barato?

Os preços de tabela — diretamente com a Anthropic, além da tarifa atual do GPT Proto:

  Entrada / 1 milhão Saída / 1 milhão
Sonnet 5 — introdutório (até 31 de agosto de 2026) $2 $10
Sonnet 5 — padrão (a partir de 1º de setembro de 2026) $3 $15
Sonnet 5 — via GPT Proto (atual) $1.6 $8
Sonnet 4.6 $3 $15
Opus 4.8 $5 $25

No preço padrão, o Sonnet 5 custa o mesmo por token que o 4.6 e fica bem abaixo do Opus 4.8. Simples. Exceto que o preço por token não representa a conta inteira.

O Sonnet 5 vem com um novo tokenizador — o mesmo que a Anthropic introduziu com o Opus 4.7 — e o mesmo texto agora corresponde a cerca de 1,0 a 1,35× mais tokens, dependendo do tipo de conteúdo. A Anthropic é transparente sobre isso em uma nota de rodapé e sobre a consequência: o preço introdutório foi definido para que a migração do 4.6 seja aproximadamente neutra em custo durante a janela introdutória. Leia isso com atenção. Significa que o preço de lançamento de $2/$10 não é um desconto puro; parte dele compensa os tokens extras. E significa que, em 1º de setembro, quando o preço voltar a $3/$15 — idêntico ao do 4.6 no papel — uma solicitação equivalente poderá custar mais do que custava no 4.6, porque serão cobrados mais tokens pelo mesmo texto.

Então, o Sonnet 5 é mais barato que o 4.6? A resposta honesta é: depende de quando e com que intensidade você o executa. Até agosto, efetivamente sim. Depois disso, para a mesma carga de trabalho, planeje um custo por solicitação estável ou moderadamente maior, não menor — e meça seus próprios prompts com o novo tokenizador em vez de confiar na linha de preço por token.

Se você chama o Claude pelo GPT Proto em vez de diretamente, o Sonnet 5 está disponível na plataforma por $1.6 / 1 milhão de tokens de entrada e $8 / 1 milhão de tokens de saída — 20% abaixo da tarifa introdutória de $2/$10 da Anthropic, o que o torna o caminho mais barato enquanto durar o preço de lançamento. Como referência, na mesma plataforma, o Sonnet 4.6 custa $2.4/$12 e o Opus 4.8 custa $4/$20. As chamadas executáveis na próxima seção apontam diretamente para o Sonnet 5.

Como usar o Claude Sonnet 5 pela API

O Sonnet 5 já está disponível no GPT Proto, portanto os exemplos executáveis abaixo o chamam diretamente na página do modelo Claude Sonnet 5. Se você estiver migrando do 4.6, esta é a substituição direta anunciada pela Anthropic — troque claude-sonnet-4-6 por claude-sonnet-5 e mantenha o restante da chamada inalterado.

O GPT Proto disponibiliza o Claude no formato nativo Messages da Anthropic em https://gptproto.com/v1/messages, com um token Bearer. Primeiro, cURL:

curl --request POST "https://gptproto.com/v1/messages" \
  --header "Authorization: Bearer $GPTPROTO_API_KEY" \
  --header "Content-Type: application/json" \
  --header "anthropic-version: 2023-06-01" \
  --data '{
    "model": "claude-sonnet-5",
    "max_tokens": 1024,
    "messages": [
      { "role": "user", "content": "Explain what an agentic coding model does in two sentences." }
    ]
  }'

A mesma chamada em Python, usando apenas requests:

import os
import requests
 
resp = requests.post(
    "https://gptproto.com/v1/messages",
    headers={
        "Authorization": f"Bearer {os.environ['GPTPROTO_API_KEY']}",
        "Content-Type": "application/json",
        "anthropic-version": "2023-06-01",
    },
    json={
        "model": "claude-sonnet-5",
        "max_tokens": 1024,
        "messages": [
            {"role": "user", "content": "Explain what an agentic coding model does in two sentences."}
        ],
    },
    timeout=60,
)
resp.raise_for_status()
data = resp.json()
print(data["content"][0]["text"])

Ao migrar para o Sonnet 5, leve duas coisas em consideração. Primeiro, a mudança no tokenizador significa que suas contagens de tokens — e, portanto, sua conta e a margem de max_tokens— mudam mesmo que o texto não mude; faça uma nova medição antes de presumir que seus limites atuais continuam adequados. Segundo, se algum código atual definir temperature, top_p ou top_k com valores personalizados, ou ativar o pensamento estendido manual, remova essas configurações: no Sonnet 5, elas retornam um erro 400.

Uma única chave no GPT Proto dá acesso ao Claude e a mais de 200 outros modelos usando um único saldo, para que você possa comparar o Sonnet 5 com, por exemplo, um modelo mais barato no mesmo caminho de solicitação, sem administrar vários provedores. A lista completa está no catálogo de modelos.

Sonnet 5 vs Sonnet 4.6 (e se você ainda estiver no 4.5 ou 3.5)

Esta é a comparação direta que eu usaria para decidir, mantendo o Opus 4.8 como referência do teto de capacidade:

  Sonnet 5 Sonnet 4.6 Opus 4.8
Posicionamento Trabalho agêntico próximo ao Opus pelo preço do Sonnet Padrão intermediário anterior Teto de precisão
Programação (SWE-bench Pro) 63.2% 58.1% 69.2%
Melhor valor em Esforço baixo / médio — Tarefas mais difíceis
Preço padrão (entrada/saída por 1 milhão) $3 / $15 $3 / $15 $5 / $25
Contexto 1 milhão até 1 milhão 200 mil
Ressalva de custo O novo tokenizador cobra mais tokens; xhigh pode superar o custo do Opus Tokenizador familiar Preço pensado para o nível máximo

Minha leitura: se você está no 4.6 e executa trabalhos agênticos ou de programação de forma contínua, o Sonnet 5 é a atualização que vale testar — os ganhos em programação e uso de ferramentas são reais, e o preço introdutório torna o teste barato. Se sua carga de trabalho exige precisão no nível máximo — o tipo de tarefa em que uma resposta errada é cara — mantenha o Opus 4.8 no circuito e reserve o Sonnet 5 para o volume intermediário. E, se você utiliza constantemente o esforço xhigh, isso é um sinal para calcular o preço do Opus 4.8, não um motivo para presumir que o Sonnet é mais barato.

Ainda está no Sonnet 4.5 ou 3.5? Então o caso para atualizar é ainda mais forte, mas eu evitaria citar um benchmark limpo de "5 contra 3.5", porque a Anthropic não publicou um — todos os números de comparações diretas acima são contra o 4.6. O que posso dizer é uma indicação direcional: há duas gerações de avanços agênticos entre o 3.5 e o 5, a maioria exatamente no uso de ferramentas e na confiabilidade em tarefas longas, áreas em que os Sonnets mais antigos ficavam aquém. A medida prática é a mesma, independentemente do ponto de partida: aponte seu código para o Sonnet 5 no GPT Proto e deixe o controle de esforço cuidar do restante.

Vale a pena? Uma análise honesta

A recepção no primeiro dia foi dividida, e essa divisão é reveladora. Os elogios se concentraram na relação preço-valor da tarifa introdutória. As dúvidas se concentraram na mesma questão que este guia continua examinando: se o modelo se sustenta quando o preço padrão de $3/$15 retornar e a inflação de tokens do tokenizador começar a pesar silenciosamente.

O sinal mais útil que vi não foi um benchmark — foi uma análise prática de uma equipe de ferramentas de revisão de código que o executou em trabalho real. A conclusão tem dois lados, e é por isso que confio nela: para escrever e criar código, o Sonnet 5 foi o modelo mais forte que eles haviam usado nessa categoria. Para revisar código, houve um compromisso — comentários mais limpos e precisos, mas menos bugs detectados do que pelos modelos que já executam em produção, a um custo por revisão ligeiramente maior. Eles também perceberam dois hábitos que aparecem como produtividade nos ciclos de agentes: o modelo tende a escrever testes antes do recurso e reescreve o próprio plano no meio de uma tarefa longa, em vez de seguir cegamente um plano obsoleto. A ressalva apontada por eles coincide com a própria observação da Anthropic — as novas proteções cibernéticas ocasionalmente são acionadas por trabalhos legítimos de segurança.

Vale lembrar: as citações entusiasmadas na publicação de lançamento vêm de parceiros de acesso antecipado da Anthropic. Elas são reais, mas foram selecionadas, e um fornecedor escolher seus próprios depoimentos não constitui evidência neutra. A análise prática independente — forte na geração, mais fraca e mais cara na revisão — é a referência inicial mais honesta.

Então, quem deve migrar? Equipes que fazem programação em alto volume, usam ferramentas, automatizam navegadores e terminais ou executam trabalho de conhecimento pelo qual estavam pagando demais pelo Opus — migrem, e façam isso durante a janela introdutória, enquanto o teste estiver barato. Equipes cujo ciclo principal envolve revisão cuidadosa ou decisões críticas para a precisão — testem, mas não aposentem o modelo atual no dia do lançamento e executem novamente sua própria suíte de avaliações antes de se comprometerem.


Em resumo: o Sonnet 5 é um avanço real para trabalhos agênticos e de programação, e o preço introdutório torna barato experimentá-lo — apenas não interprete "mesmo preço de lista do 4.6" como "mesma conta" e calcule o preço do Opus 4.8 antes de aumentar o controle de esforço. Hoje, você pode chamar o Claude Sonnet 5 no GPT Proto por $1.6 / $8 — 20% abaixo da tarifa de lançamento da Anthropic — usando um único saldo e uma única chave de API, com acesso a mais de 200 modelos caso queira direcionar chamadas sensíveis a custo para outro modelo.

Creative Studio

Gere imagem, vídeo e mais com APIs de produção.

Começar a criar
Creative Studio
Modelos relacionados
Todos os modelos
Claude
10% OFF
Claude
10% OFF
Claude
10% OFF
OpenAI
20% OFF

Perguntas frequentes

O Claude Sonnet 5 está disponível?

Sim. A Anthropic o lançou em 30 de junho de 2026 como o modelo padrão dos planos Free e Pro, disponível para seleção nos planos Max, Team e Enterprise, além de disponibilizá-lo no Claude Code e pela API. Ele também está disponível no GPTProto — você pode acessá-lo na página do modelo Claude Sonnet 5.

Quanto custa o Claude Sonnet 5?

$2 por 1 milhão de tokens de entrada e $10 por 1 milhão de tokens de saída até 31 de agosto de 2026; depois, $3 / $15. Uma ressalva: ele usa um novo tokenizador que converte o mesmo texto em aproximadamente 1,0–1,35× mais tokens. Portanto, meça seus próprios prompts em vez de calcular o custo diretamente pelo preço por token.

Na prática, o Sonnet 5 é mais barato que o Sonnet 4.6?

Até agosto, efetivamente sim. Depois da janela introdutória, o preço por token é o mesmo do 4.6, mas o novo tokenizador cobra mais tokens pelo mesmo texto, portanto uma solicitação equivalente pode custar moderadamente mais, e não menos. Isso depende do seu volume e da data.

Posso trocar diretamente meu código do Sonnet 4.6 para o Sonnet 5?

Em grande parte, sim. Ele é um substituto direto, portanto a string do modelo é a principal mudança. Mas faça uma nova medição das contagens de tokens e de max_tokens com o novo tokenizador e remova quaisquer parâmetros de amostragem personalizados (temperature, top_p, top_k) ou chamadas de pensamento estendido manual — eles retornam um erro 400 no Sonnet 5.

Artigos relacionados

Mais blogs
API do Claude 4.5: Guia completo de configuração, preços e integração para desenvolvedores

API do Claude 4.5: Guia completo de configuração, preços e integração para desenvolvedores

Resumo O Claude 4.5 (lançado em setembro de 2025) apresenta o Sonnet 4.5—o melhor modelo de programação do mundo—e o Haiku 4.5, ambos com recursos de raciocínio estendido. O Sonnet 4.5 alcança 77,2% no SWE-bench, opera de forma autônoma por mais de 30 horas e mantém preços de US$ 3/US$ 15 por milhão de tokens. O Haiku 4.5 oferece inteligência próxima à de modelos de ponta por US$ 1/US$ 5—um terço do custo e com o dobro da velocidade. Ambos são compatíveis com novos recursos: ferramenta de memória, edição de contexto e modos de raciocínio híbrido.

Schuyler Stacy | 2026-02-03

Claude Fable 5: O Guia Completo e Análise Honesta (2026)

Claude Fable 5: O Guia Completo e Análise Honesta (2026)

A Anthropic passou meses alertando que seus modelos mais capazes estavam ficando perigosos demais para serem lançados amplamente. Então, em 9 de junho de 2026, lançou um mesmo assim — mais ou menos. Claude Fable 5 é o primeiro modelo do nível superior “Mythos” da Anthropic que o público pode realmente acessar, e está um nível completo acima da família Opus. A ressalva é incomum: em uma parcela de perguntas sensíveis, a versão pela qual você está pagando encaminhará silenciosamente sua solicitação para um modelo diferente e mais fraco, que responderá a partir daí. Essa única decisão de design revela grande parte do que torna o Fable 5 diferente, por isso é por onde este guia começa. Este é um guia prático para desenvolvedores, não um resumo do dia do lançamento. Reunimos as especificações e o comportamento a partir da própria documentação da Anthropic, de benchmarks independentes e dos primeiros testes práticos publicados desde o lançamento — e deixamos de fora os números que não pudemos verificar.

Schuyler Stacy | 2026-06-11

O que é o GLM 5.2? Codificação com pesos abertos por 1/6 do preço

O que é o GLM 5.2? Codificação com pesos abertos por 1/6 do preço

Um laboratório chinês lançou um modelo que você pode baixar gratuitamente, executar no seu próprio hardware e usar por aproximadamente um sexto do que os modelos de fronteira fechados cobram — e que fica alguns pontos atrás do Claude Opus 4.8 em benchmarks reais de codificação. Depois, lançou o modelo sem publicar um único benchmark oficial próprio. Esse é o GLM 5.2, e a distância entre "nenhum número de marketing" e "perto do topo de todas as tabelas de classificação independentes em uma semana" é justamente o que torna esse modelo tão interessante de entender. Escrevo muitos desses artigos explicativos, e a maioria das publicações sobre novos modelos é esquecível porque apenas repete uma ficha técnica. Este é diferente em um aspecto que realmente importa para desenvolvedores: os pesos são abertos sob uma licença MIT, então a pergunta habitual — "o benchmark é real ou é marketing?" — tem uma resposta particularmente clara. As pessoas baixaram o modelo e o testaram por conta própria. Veja o que é o GLM 5.2, como ele funciona e quais são seus limites.

Michael Johnson | 2026-07-15

API do Doubao: O guia completo (2026) — qual modelo chamar e como

API do Doubao: O guia completo (2026) — qual modelo chamar e como

Pesquise por “doubao api” e você rapidamente encontra um obstáculo. O console oficial é o Volcano Engine, as páginas vêm configuradas em chinês e o cadastro exige uma verificação de identidade que a maioria dos desenvolvedores fora da China não consegue concluir em uma tarde. Depois há a questão dos nomes. Doubao, Dola, Cici, Seed, Seedream, Seedance, Volcengine — todos pertencem à ByteDance, e nenhum deles é obviamente aquilo que você digitou na caixa de pesquisa. Escrevo guias de integração para o GPTProto, e Doubao é a família de modelos sobre a qual mais me perguntam. Portanto, este é o guia que eu gostaria que existisse: qual modelo Doubao serve para cada tarefa, quanto cada um realmente custa e código pronto para copiar e colar que os chama — texto, imagem e vídeo — a partir de um único endpoint, sem precisar de um número de telefone chinês. Este é um quadro produzido pelo modelo de vídeo Seedance 2.0 a partir de um prompt de texto, chamado pela API exatamente da maneira que o código mais abaixo faz. Vamos chegar até ele.

Schuyler Stacy | 2026-06-23