¿Qué es Claude Sonnet 5?
Sonnet 5 es el modelo de gama media más reciente de Anthropic, presentado como su Sonnet más agéntico hasta la fecha: planifica, controla navegadores y terminales, y ejecuta tareas de varios pasos por su cuenta. El enfoque principal de Anthropic es la relación coste-rendimiento — un rendimiento cercano al de Opus 4.8, a precios de Sonnet.
Por qué importa ese enfoque antes de entrar en los detalles: durante la mayor parte del último año, los mayores avances agénticos se produjeron en la gama Opus, no en Sonnet. Por eso, los equipos que ejecutaban trabajo agéntico de gran volumen tenían que pagar tarifas de Opus por capacidades que solo necesitaban parte del tiempo. Sonnet 5 es el intento de Anthropic de llevar una parte de esas capacidades a un nivel de precios inferior. Ese es el «porqué» y explica la mayoría de las decisiones de diseño que siguen.
Según la documentación de Anthropic: es un reemplazo directo de Sonnet 4.6, utiliza el ID de modelo de API claude-sonnet-5, incluye una ventana de contexto de 1M de tokens tanto por defecto como como máximo, y admite hasta 128k tokens de salida. Recibe texto e imágenes y genera texto.
| |
Claude Sonnet 5 |
| Lanzamiento |
30 de junio de 2026 |
| ID de modelo de API |
claude-sonnet-5 |
| Ventana de contexto |
1M de tokens (por defecto y máximo) |
| Salida máxima |
128k tokens |
| Entrada / salida |
Entrada de texto e imagen, salida de texto |
| Relación con 4.6 |
Reemplazo directo |
Novedades frente a Sonnet 4.6
Si ya utilizas Sonnet 4.6, la actualización no consiste únicamente en cambiar los pesos. Según la documentación de Anthropic, tres cambios de comportamiento afectarán a tu código:
- El razonamiento adaptativo está activado de forma predeterminada.
- El razonamiento extendido manual ahora devuelve un error 400 (ya estaba obsoleto en 4.6).
- Establecer parámetros de muestreo — temperature, top_p, top_k — en valores no predeterminados devuelve un error 400.
Hay otros dos cambios importantes desde el punto de vista operativo. Sonnet 5 ofrece niveles de esfuerzo (low, medium, high y xhigh): un esfuerzo mayor utiliza más tokens para razonar y obtener más calidad — y también más coste. Además, es el primer modelo de la gama Sonnet con medidas de ciberseguridad en tiempo real activadas por defecto. Esas medidas tienen una particularidad que conviene conocer antes de integrarlas en un agente: cuando el modelo rechaza una solicitud marcada, el rechazo vuelve como un HTTP 200 correcto con stop_reason: "refusal", no como un error. Si tu gestión de errores supone que un rechazo lanza una excepción, no funcionará.
Sin embargo, el cambio con mayor impacto es uno que nadie destaca en los titulares: el tokenizador. Le dedico una sección propia porque cambia las cuentas de precios.
Funciones y rendimiento principales
Anthropic presenta Sonnet 5 como una mejora clara frente a 4.6 en razonamiento, uso de herramientas, programación y trabajo de conocimiento, y como un modelo suficientemente cercano a Opus 4.8 para que puedas elegir tu punto en la curva coste-rendimiento mediante el selector de esfuerzo. Las cifras concretas de los benchmarks que aparecen abajo proceden de los materiales de lanzamiento de Anthropic y de la cobertura del primer día; considera las cifras exactas como datos comunicados por Anthropic hasta que hayas leído la System Card.
| Benchmark |
Sonnet 5 |
Sonnet 4.6 |
Opus 4.8 |
| SWE-bench Pro (programación agéntica) |
63.2% |
58.1% |
69.2% |
| OSWorld-Verified (uso del ordenador) |
81.2% |
78.5% |
— |
| Terminal-Bench 2.1 |
80.4% |
67.0% |
— |
| Humanity's Last Exam (con herramientas) |
57.4% |
46.8% |
57.9% |
| GDPval-AA v2 (trabajo de conocimiento) |
1,618 |
— |
1,615 |
Cifras comunicadas en el lanzamiento de Anthropic del 30 de junio de 2026; los guiones corresponden a celdas que no pude confirmar.
Lee la tabla con honestidad y destacan dos cosas. En programación, Sonnet 5 supera a 4.6 por un margen real, pero aún queda por debajo de Opus 4.8 — reduce la diferencia, pero no la elimina. En trabajo de conocimiento, supera a Opus 4.8 por muy poco (1,618 frente a 1,615), que es el origen de la frase «a veces supera a Opus» que verás repetida en todas partes; es cierto, pero por muy poco y en un único benchmark.
Este es el coste que omite el resumen de lo más destacado. Los gráficos de Anthropic muestran que la mejor relación calidad-precio de Sonnet 5 se obtiene con un esfuerzo bajo y medio. Si lo llevas a xhigh, los informes del día del lanzamiento dicen que el coste puede superar al de Opus 4.8 con una calidad similar. Por tanto, «más barato que Opus» incluye una salvedad: es más barato en los niveles de esfuerzo en los que realmente elegirías un Sonnet, no necesariamente cuando lo llevas al máximo. Mi conclusión: si una tarea necesita de verdad un razonamiento xhigh, calcula primero el precio de Opus 4.8 antes de elegir Sonnet 5 por defecto — la intuición de que el modelo más pequeño siempre es más barato deja de cumplirse en la parte superior del selector.
En seguridad, Anthropic informa de tasas más bajas de alucinaciones, adulación y comportamientos no deseados que en 4.6, además de una mayor resistencia a solicitudes maliciosas y secuestros mediante inyección de prompts. La salvedad que publican ellos mismos: Sonnet 5 sigue mostrando una tasa de comportamiento desalineado superior a Opus 4.8 en su auditoría interna. En ciberseguridad, nunca produjo un exploit completo y funcional durante las pruebas — su capacidad es deliberadamente baja en ese ámbito, lo que resulta positivo si estás lanzando un agente orientado a clientes, pero limitante si tu caso de uso es el trabajo de seguridad autorizado.
Precios de Claude Sonnet 5: ¿realmente es más barato?
Los precios anunciados — directamente con Anthropic y la tarifa actual de GPT Proto:
| |
Entrada / 1M |
Salida / 1M |
| Sonnet 5 — introductorio (hasta el 31 de agosto de 2026) |
$2 |
$10 |
| Sonnet 5 — estándar (desde el 1 de septiembre de 2026) |
$3 |
$15 |
| Sonnet 5 — mediante GPT Proto (actual) |
$1.6 |
$8 |
| Sonnet 4.6 |
$3 |
$15 |
| Opus 4.8 |
$5 |
$25 |
Con el precio estándar, Sonnet 5 cuesta lo mismo por token que 4.6 y bastante menos que Opus 4.8. Sencillo. Excepto que el precio por token no es el coste total.
Sonnet 5 incluye un tokenizador nuevo — el mismo que Anthropic introdujo con Opus 4.7 — y el mismo texto ahora se convierte en aproximadamente entre 1,0 y 1,35× más tokens, según el tipo de contenido. Anthropic lo explica claramente en una nota al pie, junto con la consecuencia: el precio introductorio está establecido para que el cambio desde 4.6 sea aproximadamente neutro en costes durante el periodo introductorio. Léelo con atención. Significa que el precio de lanzamiento de $2/$10 no es un descuento puro; una parte compensa los tokens adicionales. Y significa que el 1 de septiembre, cuando el precio vuelva a $3/$15 — idéntico al de 4.6 sobre el papel — una solicitud equivalente puede costarte más que con 4.6, porque se facturan más tokens por el mismo texto.
Entonces, ¿Sonnet 5 es más barato que 4.6? La respuesta honesta es: depende de cuándo y con qué intensidad lo ejecutes. Hasta agosto, en la práctica, sí. Después, para el mismo volumen de trabajo, calcula un coste por solicitud estable o ligeramente superior, no inferior — y mide tus propios prompts con el nuevo tokenizador en lugar de confiar en la línea del precio por token.
Si utilizas Claude mediante GPT Proto en vez de hacerlo directamente, Sonnet 5 está disponible en la plataforma a $1.6 / 1M de entrada y $8 / 1M de salida — un 20 % menos que la tarifa introductoria de Anthropic de $2/$10, lo que lo convierte en la opción más barata mientras dure el precio de lanzamiento. Como referencia, en la misma plataforma Sonnet 4.6 cuesta $2.4/$12 y Opus 4.8 $4/$20. Las llamadas ejecutables de la siguiente sección apuntan directamente a Sonnet 5.
Cómo usar Claude Sonnet 5 mediante la API
Sonnet 5 ya está disponible en GPT Proto, por lo que los ejemplos ejecutables de abajo lo llaman directamente desde la página del modelo Claude Sonnet 5. Si estás migrando desde 4.6, este es el cambio directo que anuncia Anthropic — cambia claude-sonnet-4-6 por claude-sonnet-5 y deja intacto el resto de la llamada.
GPT Proto ofrece Claude en el formato nativo Messages de Anthropic en https://gptproto.com/v1/messages, con un token Bearer. Primero, cURL:
curl --request POST "https://gptproto.com/v1/messages" \
--header "Authorization: Bearer $GPTPROTO_API_KEY" \
--header "Content-Type: application/json" \
--header "anthropic-version: 2023-06-01" \
--data '{
"model": "claude-sonnet-5",
"max_tokens": 1024,
"messages": [
{ "role": "user", "content": "Explain what an agentic coding model does in two sentences." }
]
}'
La misma llamada en Python, utilizando únicamente requests:
import os
import requests
resp = requests.post(
"https://gptproto.com/v1/messages",
headers={
"Authorization": f"Bearer {os.environ['GPTPROTO_API_KEY']}",
"Content-Type": "application/json",
"anthropic-version": "2023-06-01",
},
json={
"model": "claude-sonnet-5",
"max_tokens": 1024,
"messages": [
{"role": "user", "content": "Explain what an agentic coding model does in two sentences."}
],
},
timeout=60,
)
resp.raise_for_status()
data = resp.json()
print(data["content"][0]["text"])
Hay dos cosas que debes tener en cuenta al migrar a Sonnet 5. Primero, el cambio de tokenizador significa que tus recuentos de tokens — y, por tanto, tu factura y el margen de max_tokens — cambian aunque el texto no lo haga; vuelve a medir antes de asumir que tus límites actuales siguen siendo suficientes. Segundo, si alguno de tus códigos actuales establece temperature, top_p o top_k en valores personalizados, o activa el razonamiento extendido manual, elimínalos: en Sonnet 5 devuelven un error 400.
Una única clave en GPT Proto da acceso a Claude y a más de 200 modelos con un mismo saldo, así que puedes comparar Sonnet 5 con, por ejemplo, un modelo más barato en la misma ruta de solicitud sin tener que gestionar varios proveedores. La lista completa está en el catálogo de modelos.
Sonnet 5 frente a Sonnet 4.6 (y si todavía usas 4.5 o 3.5)
Esta es la comparación directa que realmente utilizaría para decidir, manteniendo Opus 4.8 como techo de referencia:
| |
Sonnet 5 |
Sonnet 4.6 |
Opus 4.8 |
| Posicionamiento |
Trabajo agéntico cercano a Opus a precio de Sonnet |
Estándar anterior de gama media |
Techo de precisión |
| Programación (SWE-bench Pro) |
63.2% |
58.1% |
69.2% |
| Mejor relación calidad-precio con |
Esfuerzo bajo / medio |
— |
Tareas más difíciles |
| Precio estándar (entrada/salida por 1M) |
$3 / $15 |
$3 / $15 |
$5 / $25 |
| Contexto |
1M |
hasta 1M |
200k |
| Advertencia sobre el coste |
El nuevo tokenizador factura más tokens; xhigh puede superar el coste de Opus |
Tokenizador conocido |
Precio pensado para el extremo superior |
Mi conclusión: si utilizas 4.6 y realizas trabajo agéntico o de programación de forma continuada, Sonnet 5 es la actualización que debes probar — las mejoras en programación y uso de herramientas son reales, y el precio introductorio hace que probarlo sea barato. Si tu carga de trabajo exige precisión en el nivel más alto — tareas en las que una respuesta incorrecta resulta costosa — mantén Opus 4.8 en la mezcla y reserva Sonnet 5 para el volumen intermedio. Y si recurres constantemente al esfuerzo xhigh, es una señal para calcular el precio de Opus 4.8, no un motivo para asumir que Sonnet es más barato.
¿Sigues usando Sonnet 4.5 o 3.5? Entonces el caso a favor de la actualización es aún más sólido, pero evitaría citar un benchmark limpio de «5 frente a 3.5», porque Anthropic no publicó ninguno — todas las cifras comparativas anteriores son frente a 4.6. Lo que sí puedo decir es orientativo: entre 3.5 y 5 hay dos generaciones de avances agénticos, sobre todo en el uso de herramientas y la fiabilidad en tareas largas, precisamente los aspectos en los que los Sonnet antiguos se quedaban cortos. El paso práctico es el mismo independientemente de tu punto de partida: dirige tu código a Sonnet 5 en GPT Proto y deja que el selector de esfuerzo haga el resto.
¿Merece la pena? Una opinión sincera
La recepción del primer día estuvo dividida, y esa división resulta reveladora. Los elogios se centraron en la relación valor-precio de la tarifa introductoria. Las dudas se concentraron en la misma pregunta que recorre esta guía: si seguirá siendo competitivo cuando vuelva el precio estándar de $3/$15 y la inflación de tokens del tokenizador esté haciendo su trabajo silencioso.
La señal más útil que vi no fue un benchmark, sino una reseña práctica de un equipo de herramientas de revisión de código que lo probó con trabajo real. Su conclusión tiene dos caras, y por eso confío en ella: para escribir y crear código, Sonnet 5 era el modelo más potente que habían utilizado en esta gama. Para revisar código, era un intercambio: comentarios más limpios y precisos, pero detectaba menos errores que los modelos que ya ejecutaban en producción, con un coste por revisión ligeramente superior. También observaron dos hábitos que se traducen en productividad en los ciclos agénticos: suele escribir las pruebas antes que la funcionalidad y reescribe su propio plan a mitad de una tarea larga, en lugar de seguir ciegamente un plan obsoleto hasta el desastre. La pega que señalaron coincide con la propia nota de Anthropic: las nuevas medidas de ciberseguridad pueden activarse ocasionalmente durante trabajos de seguridad legítimos.
Conviene recordarlo: las citas entusiastas del anuncio proceden de los socios de acceso anticipado de Anthropic. Son reales, pero están seleccionadas, y que un proveedor elija sus propios testimonios no constituye una evidencia neutral. La evaluación práctica independiente — fuerte en generación, más débil y cara en revisión — es el punto de referencia más honesto.
Entonces, ¿quién debería cambiar? Los equipos que realizan programación de gran volumen, uso de herramientas, automatización de navegadores y terminales o trabajo de conocimiento por el que pagaban de más con Opus deberían cambiar, y hacerlo durante el periodo introductorio, mientras probarlo sea barato. Los equipos cuyo ciclo principal consiste en revisiones cuidadosas o decisiones críticas para la precisión deberían probarlo, pero no retirar su modelo actual el día del lanzamiento; vuelve a ejecutar tu propia batería de evaluaciones antes de comprometerte.
En resumen: Sonnet 5 supone un avance real para el trabajo agéntico y de programación, y el precio introductorio hace que probarlo sea barato. No interpretes «el mismo precio de lista que 4.6» como «la misma factura», y calcula el precio de Opus 4.8 antes de subir el selector de esfuerzo. Hoy puedes utilizar Claude Sonnet 5 en GPT Proto por $1.6 / $8 — un 20 % menos que la tarifa de lanzamiento de Anthropic — con un único saldo y una única clave de API, entre más de 200 modelos si quieres derivar las llamadas sensibles al coste a otro modelo.