Schuyler Stacy2026-07-01

Claude Sonnet 5: Qué hay de nuevo, cuánto cuesta y cómo se compara con Sonnet 4.6 (Guía de 2026)

Guía de Claude Sonnet 5: novedades frente a Sonnet 4.6, benchmarks, precios de $2/$10, el detalle del tokenizador que cambia tu factura y código de API ejecutable.

Claude Sonnet 5: Qué hay de nuevo, cuánto cuesta y cómo se compara con Sonnet 4.6 (Guía de 2026)

Anthropic lanzó Claude Sonnet 5 el 30 de junio de 2026 y, en menos de una hora, mis feeds se llenaron de las mismas dos preguntas: ¿debería dejar Sonnet 4.6 y es realmente cierta la afirmación de que tiene «el mismo precio de lista que 4.6» cuando se ejecuta tráfico real? Esas son también las preguntas que me interesan, así que esta guía gira en torno a ellas, no al resumen de lo más destacado del anuncio. Todo lo técnico aquí se basa en el anuncio y la documentación de Anthropic; cuando una cifra procede de la prensa y no de una página que pude leer directamente, lo indico.

Una aclaración inicial, porque muchas de las primeras reseñas se equivocan: el predecesor de Sonnet 5 es Sonnet 4.6 (lanzado en febrero de 2026), no Sonnet 4.5. Si lo comparas con 4.5 o con un 3.5 aún más antiguo, estás comparando dos actualizaciones, y las cifras de abajo no coincidirán. Volveré sobre esto.

Tabla de contenido

¿Qué es Claude Sonnet 5?

Sonnet 5 es el modelo de gama media más reciente de Anthropic, presentado como su Sonnet más agéntico hasta la fecha: planifica, controla navegadores y terminales, y ejecuta tareas de varios pasos por su cuenta. El enfoque principal de Anthropic es la relación coste-rendimiento — un rendimiento cercano al de Opus 4.8, a precios de Sonnet.

Por qué importa ese enfoque antes de entrar en los detalles: durante la mayor parte del último año, los mayores avances agénticos se produjeron en la gama Opus, no en Sonnet. Por eso, los equipos que ejecutaban trabajo agéntico de gran volumen tenían que pagar tarifas de Opus por capacidades que solo necesitaban parte del tiempo. Sonnet 5 es el intento de Anthropic de llevar una parte de esas capacidades a un nivel de precios inferior. Ese es el «porqué» y explica la mayoría de las decisiones de diseño que siguen.

Según la documentación de Anthropic: es un reemplazo directo de Sonnet 4.6, utiliza el ID de modelo de API claude-sonnet-5, incluye una ventana de contexto de 1M de tokens tanto por defecto como como máximo, y admite hasta 128k tokens de salida. Recibe texto e imágenes y genera texto.

  Claude Sonnet 5
Lanzamiento 30 de junio de 2026
ID de modelo de API claude-sonnet-5
Ventana de contexto 1M de tokens (por defecto y máximo)
Salida máxima 128k tokens
Entrada / salida Entrada de texto e imagen, salida de texto
Relación con 4.6 Reemplazo directo

Novedades frente a Sonnet 4.6

Si ya utilizas Sonnet 4.6, la actualización no consiste únicamente en cambiar los pesos. Según la documentación de Anthropic, tres cambios de comportamiento afectarán a tu código:

  • El razonamiento adaptativo está activado de forma predeterminada.
  • El razonamiento extendido manual ahora devuelve un error 400 (ya estaba obsoleto en 4.6).
  • Establecer parámetros de muestreo — temperature, top_p, top_k — en valores no predeterminados devuelve un error 400.
    Hay otros dos cambios importantes desde el punto de vista operativo. Sonnet 5 ofrece niveles de esfuerzo (low, medium, high y xhigh): un esfuerzo mayor utiliza más tokens para razonar y obtener más calidad — y también más coste. Además, es el primer modelo de la gama Sonnet con medidas de ciberseguridad en tiempo real activadas por defecto. Esas medidas tienen una particularidad que conviene conocer antes de integrarlas en un agente: cuando el modelo rechaza una solicitud marcada, el rechazo vuelve como un HTTP 200 correcto con stop_reason: "refusal", no como un error. Si tu gestión de errores supone que un rechazo lanza una excepción, no funcionará.

Sin embargo, el cambio con mayor impacto es uno que nadie destaca en los titulares: el tokenizador. Le dedico una sección propia porque cambia las cuentas de precios.

Funciones y rendimiento principales

Anthropic presenta Sonnet 5 como una mejora clara frente a 4.6 en razonamiento, uso de herramientas, programación y trabajo de conocimiento, y como un modelo suficientemente cercano a Opus 4.8 para que puedas elegir tu punto en la curva coste-rendimiento mediante el selector de esfuerzo. Las cifras concretas de los benchmarks que aparecen abajo proceden de los materiales de lanzamiento de Anthropic y de la cobertura del primer día; considera las cifras exactas como datos comunicados por Anthropic hasta que hayas leído la System Card.

Benchmark Sonnet 5 Sonnet 4.6 Opus 4.8
SWE-bench Pro (programación agéntica) 63.2% 58.1% 69.2%
OSWorld-Verified (uso del ordenador) 81.2% 78.5%
Terminal-Bench 2.1 80.4% 67.0%
Humanity's Last Exam (con herramientas) 57.4% 46.8% 57.9%
GDPval-AA v2 (trabajo de conocimiento) 1,618 1,615

Cifras comunicadas en el lanzamiento de Anthropic del 30 de junio de 2026; los guiones corresponden a celdas que no pude confirmar.

Lee la tabla con honestidad y destacan dos cosas. En programación, Sonnet 5 supera a 4.6 por un margen real, pero aún queda por debajo de Opus 4.8  — reduce la diferencia, pero no la elimina. En trabajo de conocimiento, supera a Opus 4.8 por muy poco (1,618 frente a 1,615), que es el origen de la frase «a veces supera a Opus» que verás repetida en todas partes; es cierto, pero por muy poco y en un único benchmark.

Este es el coste que omite el resumen de lo más destacado. Los gráficos de Anthropic muestran que la mejor relación calidad-precio de Sonnet 5 se obtiene con un esfuerzo bajo y medio. Si lo llevas a xhigh, los informes del día del lanzamiento dicen que el coste puede superar al de Opus 4.8 con una calidad similar. Por tanto, «más barato que Opus» incluye una salvedad: es más barato en los niveles de esfuerzo en los que realmente elegirías un Sonnet, no necesariamente cuando lo llevas al máximo. Mi conclusión: si una tarea necesita de verdad un razonamiento xhigh, calcula primero el precio de Opus 4.8 antes de elegir Sonnet 5 por defecto — la intuición de que el modelo más pequeño siempre es más barato deja de cumplirse en la parte superior del selector.

En seguridad, Anthropic informa de tasas más bajas de alucinaciones, adulación y comportamientos no deseados que en 4.6, además de una mayor resistencia a solicitudes maliciosas y secuestros mediante inyección de prompts. La salvedad que publican ellos mismos: Sonnet 5 sigue mostrando una tasa de comportamiento desalineado superior a Opus 4.8 en su auditoría interna. En ciberseguridad, nunca produjo un exploit completo y funcional durante las pruebas — su capacidad es deliberadamente baja en ese ámbito, lo que resulta positivo si estás lanzando un agente orientado a clientes, pero limitante si tu caso de uso es el trabajo de seguridad autorizado.

Precios de Claude Sonnet 5: ¿realmente es más barato?

Los precios anunciados — directamente con Anthropic y la tarifa actual de GPT Proto:

  Entrada / 1M Salida / 1M
Sonnet 5 — introductorio (hasta el 31 de agosto de 2026) $2 $10
Sonnet 5 — estándar (desde el 1 de septiembre de 2026) $3 $15
Sonnet 5 — mediante GPT Proto (actual) $1.6 $8
Sonnet 4.6 $3 $15
Opus 4.8 $5 $25

Con el precio estándar, Sonnet 5 cuesta lo mismo por token que 4.6 y bastante menos que Opus 4.8. Sencillo. Excepto que el precio por token no es el coste total.

Sonnet 5 incluye un tokenizador nuevo — el mismo que Anthropic introdujo con Opus 4.7 — y el mismo texto ahora se convierte en aproximadamente entre 1,0 y 1,35× más tokens, según el tipo de contenido. Anthropic lo explica claramente en una nota al pie, junto con la consecuencia: el precio introductorio está establecido para que el cambio desde 4.6 sea aproximadamente neutro en costes durante el periodo introductorio. Léelo con atención. Significa que el precio de lanzamiento de $2/$10 no es un descuento puro; una parte compensa los tokens adicionales. Y significa que el 1 de septiembre, cuando el precio vuelva a $3/$15 — idéntico al de 4.6 sobre el papel — una solicitud equivalente puede costarte más que con 4.6, porque se facturan más tokens por el mismo texto.

Entonces, ¿Sonnet 5 es más barato que 4.6? La respuesta honesta es: depende de cuándo y con qué intensidad lo ejecutes. Hasta agosto, en la práctica, sí. Después, para el mismo volumen de trabajo, calcula un coste por solicitud estable o ligeramente superior, no inferior — y mide tus propios prompts con el nuevo tokenizador en lugar de confiar en la línea del precio por token.

Si utilizas Claude mediante GPT Proto en vez de hacerlo directamente, Sonnet 5 está disponible en la plataforma a $1.6 / 1M de entrada y $8 / 1M de salida — un 20 % menos que la tarifa introductoria de Anthropic de $2/$10, lo que lo convierte en la opción más barata mientras dure el precio de lanzamiento. Como referencia, en la misma plataforma Sonnet 4.6 cuesta $2.4/$12 y Opus 4.8 $4/$20. Las llamadas ejecutables de la siguiente sección apuntan directamente a Sonnet 5.

Cómo usar Claude Sonnet 5 mediante la API

Sonnet 5 ya está disponible en GPT Proto, por lo que los ejemplos ejecutables de abajo lo llaman directamente desde la página del modelo Claude Sonnet 5. Si estás migrando desde 4.6, este es el cambio directo que anuncia Anthropic — cambia claude-sonnet-4-6 por claude-sonnet-5 y deja intacto el resto de la llamada.

GPT Proto ofrece Claude en el formato nativo Messages de Anthropic en https://gptproto.com/v1/messages, con un token Bearer. Primero, cURL:

curl --request POST "https://gptproto.com/v1/messages" \
  --header "Authorization: Bearer $GPTPROTO_API_KEY" \
  --header "Content-Type: application/json" \
  --header "anthropic-version: 2023-06-01" \
  --data '{
    "model": "claude-sonnet-5",
    "max_tokens": 1024,
    "messages": [
      { "role": "user", "content": "Explain what an agentic coding model does in two sentences." }
    ]
  }'

La misma llamada en Python, utilizando únicamente requests:

import os
import requests
 
resp = requests.post(
    "https://gptproto.com/v1/messages",
    headers={
        "Authorization": f"Bearer {os.environ['GPTPROTO_API_KEY']}",
        "Content-Type": "application/json",
        "anthropic-version": "2023-06-01",
    },
    json={
        "model": "claude-sonnet-5",
        "max_tokens": 1024,
        "messages": [
            {"role": "user", "content": "Explain what an agentic coding model does in two sentences."}
        ],
    },
    timeout=60,
)
resp.raise_for_status()
data = resp.json()
print(data["content"][0]["text"])

Hay dos cosas que debes tener en cuenta al migrar a Sonnet 5. Primero, el cambio de tokenizador significa que tus recuentos de tokens — y, por tanto, tu factura y el margen de max_tokens — cambian aunque el texto no lo haga; vuelve a medir antes de asumir que tus límites actuales siguen siendo suficientes. Segundo, si alguno de tus códigos actuales establece temperature, top_p o top_k en valores personalizados, o activa el razonamiento extendido manual, elimínalos: en Sonnet 5 devuelven un error 400.

Una única clave en GPT Proto da acceso a Claude y a más de 200 modelos con un mismo saldo, así que puedes comparar Sonnet 5 con, por ejemplo, un modelo más barato en la misma ruta de solicitud sin tener que gestionar varios proveedores. La lista completa está en el catálogo de modelos.

Sonnet 5 frente a Sonnet 4.6 (y si todavía usas 4.5 o 3.5)

Esta es la comparación directa que realmente utilizaría para decidir, manteniendo Opus 4.8 como techo de referencia:

  Sonnet 5 Sonnet 4.6 Opus 4.8
Posicionamiento Trabajo agéntico cercano a Opus a precio de Sonnet Estándar anterior de gama media Techo de precisión
Programación (SWE-bench Pro) 63.2% 58.1% 69.2%
Mejor relación calidad-precio con Esfuerzo bajo / medio Tareas más difíciles
Precio estándar (entrada/salida por 1M) $3 / $15 $3 / $15 $5 / $25
Contexto 1M hasta 1M 200k
Advertencia sobre el coste El nuevo tokenizador factura más tokens; xhigh puede superar el coste de Opus Tokenizador conocido Precio pensado para el extremo superior

Mi conclusión: si utilizas 4.6 y realizas trabajo agéntico o de programación de forma continuada, Sonnet 5 es la actualización que debes probar — las mejoras en programación y uso de herramientas son reales, y el precio introductorio hace que probarlo sea barato. Si tu carga de trabajo exige precisión en el nivel más alto — tareas en las que una respuesta incorrecta resulta costosa — mantén Opus 4.8 en la mezcla y reserva Sonnet 5 para el volumen intermedio. Y si recurres constantemente al esfuerzo xhigh, es una señal para calcular el precio de Opus 4.8, no un motivo para asumir que Sonnet es más barato.

¿Sigues usando Sonnet 4.5 o 3.5? Entonces el caso a favor de la actualización es aún más sólido, pero evitaría citar un benchmark limpio de «5 frente a 3.5», porque Anthropic no publicó ninguno — todas las cifras comparativas anteriores son frente a 4.6. Lo que sí puedo decir es orientativo: entre 3.5 y 5 hay dos generaciones de avances agénticos, sobre todo en el uso de herramientas y la fiabilidad en tareas largas, precisamente los aspectos en los que los Sonnet antiguos se quedaban cortos. El paso práctico es el mismo independientemente de tu punto de partida: dirige tu código a Sonnet 5 en GPT Proto y deja que el selector de esfuerzo haga el resto.

¿Merece la pena? Una opinión sincera

La recepción del primer día estuvo dividida, y esa división resulta reveladora. Los elogios se centraron en la relación valor-precio de la tarifa introductoria. Las dudas se concentraron en la misma pregunta que recorre esta guía: si seguirá siendo competitivo cuando vuelva el precio estándar de $3/$15 y la inflación de tokens del tokenizador esté haciendo su trabajo silencioso.

La señal más útil que vi no fue un benchmark, sino una reseña práctica de un equipo de herramientas de revisión de código que lo probó con trabajo real. Su conclusión tiene dos caras, y por eso confío en ella: para escribir y crear código, Sonnet 5 era el modelo más potente que habían utilizado en esta gama. Para revisar código, era un intercambio: comentarios más limpios y precisos, pero detectaba menos errores que los modelos que ya ejecutaban en producción, con un coste por revisión ligeramente superior. También observaron dos hábitos que se traducen en productividad en los ciclos agénticos: suele escribir las pruebas antes que la funcionalidad y reescribe su propio plan a mitad de una tarea larga, en lugar de seguir ciegamente un plan obsoleto hasta el desastre. La pega que señalaron coincide con la propia nota de Anthropic: las nuevas medidas de ciberseguridad pueden activarse ocasionalmente durante trabajos de seguridad legítimos.

Conviene recordarlo: las citas entusiastas del anuncio proceden de los socios de acceso anticipado de Anthropic. Son reales, pero están seleccionadas, y que un proveedor elija sus propios testimonios no constituye una evidencia neutral. La evaluación práctica independiente — fuerte en generación, más débil y cara en revisión — es el punto de referencia más honesto.

Entonces, ¿quién debería cambiar? Los equipos que realizan programación de gran volumen, uso de herramientas, automatización de navegadores y terminales o trabajo de conocimiento por el que pagaban de más con Opus deberían cambiar, y hacerlo durante el periodo introductorio, mientras probarlo sea barato. Los equipos cuyo ciclo principal consiste en revisiones cuidadosas o decisiones críticas para la precisión deberían probarlo, pero no retirar su modelo actual el día del lanzamiento; vuelve a ejecutar tu propia batería de evaluaciones antes de comprometerte.


En resumen: Sonnet 5 supone un avance real para el trabajo agéntico y de programación, y el precio introductorio hace que probarlo sea barato. No interpretes «el mismo precio de lista que 4.6» como «la misma factura», y calcula el precio de Opus 4.8 antes de subir el selector de esfuerzo. Hoy puedes utilizar Claude Sonnet 5 en GPT Proto por $1.6 / $8 — un 20 % menos que la tarifa de lanzamiento de Anthropic — con un único saldo y una única clave de API, entre más de 200 modelos si quieres derivar las llamadas sensibles al coste a otro modelo.

Creative Studio

Genera imágenes, videos y más con APIs de producción.

Comenzar a crear
Creative Studio
Modelos relacionados
Todos los modelos
Claude
20% OFF
Claude
20% OFF
Claude
20% OFF
Claude
20% OFF

Preguntas frecuentes

¿Está disponible Claude Sonnet 5?

Sí. Anthropic lo lanzó el 30 de junio de 2026 como modelo predeterminado para los planes Free y Pro, seleccionable en Max, Team y Enterprise, y disponible en Claude Code y mediante la API. También está disponible en GPTProto: puedes utilizarlo desde la página del modelo Claude Sonnet 5.

¿Cuánto cuesta Claude Sonnet 5?

$2 por cada 1M de tokens de entrada y $10 por cada 1M de tokens de salida hasta el 31 de agosto de 2026; después, $3 / $15. Una salvedad: utiliza un tokenizador nuevo que convierte el mismo texto en aproximadamente entre 1,0 y 1,35× más tokens, así que mide tus propios prompts en lugar de calcular el coste únicamente a partir del precio por token.

¿Sonnet 5 es más barato que Sonnet 4.6 en la práctica?

Hasta agosto, en la práctica, sí. Después del periodo introductorio tiene el mismo precio por token que 4.6, pero el nuevo tokenizador factura más tokens para el mismo texto, por lo que una solicitud equivalente puede costar algo más, no menos. Depende de tu volumen y de la fecha.

¿Puedo cambiar directamente mi código de Sonnet 4.6 a Sonnet 5?

En su mayor parte. Es un reemplazo directo, así que la cadena del modelo es el cambio principal. Sin embargo, vuelve a medir los recuentos de tokens y max_tokens con el nuevo tokenizador, y elimina cualquier parámetro de muestreo personalizado (temperature, top_p, top_k) o llamada de razonamiento extendido manual: en Sonnet 5 devuelven un error 400.

Artículos relacionados

Más blogs
API de Claude 4.5: guía completa de configuración, precios e integración para desarrolladores

API de Claude 4.5: guía completa de configuración, precios e integración para desarrolladores

Resumen Claude 4.5 (lanzado en septiembre de 2025) incluye Sonnet 4.5—el mejor modelo de programación del mundo—y Haiku 4.5, ambos con capacidades de razonamiento extendido. Sonnet 4.5 alcanza un 77,2 % en SWE-bench, funciona de forma autónoma durante más de 30 horas y mantiene un precio de 3/15 $ por millón de tokens. Haiku 4.5 ofrece una inteligencia cercana a la frontera por 1/5 $—un tercio del coste y el doble de velocidad. Ambos admiten nuevas funciones: herramienta de memoria, edición de contexto y modos de razonamiento híbrido.

Schuyler Stacy | 2026-02-03

Claude Fable 5: guía completa y reseña honesta (2026)

Claude Fable 5: guía completa y reseña honesta (2026)

Anthropic pasó meses advirtiendo que sus modelos más capaces se estaban volviendo demasiado peligrosos para lanzarlos de forma generalizada. Después, el 9 de junio de 2026, lanzó uno de todos modos — más o menos. Claude Fable 5 es el primer modelo del nivel superior «Mythos» de Anthropic al que el público realmente puede acceder, y se encuentra un nivel completo por encima de la familia Opus. El detalle inusual es el siguiente: ante una parte de las preguntas delicadas, la versión por la que estás pagando enviará discretamente tu solicitud a un modelo diferente y más débil, que será el encargado de responder. Esa única decisión de diseño explica gran parte de lo que hace diferente a Fable 5, así que es por ahí por donde comienza esta guía. Esta es una guía práctica para desarrolladores, no un resumen del día del lanzamiento. Hemos recopilado las especificaciones y el comportamiento a partir de la documentación de Anthropic, los benchmarks independientes y las primeras pruebas prácticas publicadas desde el lanzamiento — y hemos dejado fuera las cifras que no pudimos verificar.

Schuyler Stacy | 2026-06-11

¿Qué es GLM 5.2? Código con pesos abiertos a 1/6 del precio

¿Qué es GLM 5.2? Código con pesos abiertos a 1/6 del precio

Un laboratorio chino lanzó un modelo que puedes descargar gratis, ejecutar en tu propio hardware y cuyo precio es aproximadamente una sexta parte de lo que cobran los modelos de frontera cerrados; y que queda solo unos puntos por detrás de Claude Opus 4.8 en benchmarks reales de programación. Después lanzó el modelo sin publicar un solo benchmark oficial propio. Eso es GLM 5.2, y la brecha entre «sin cifras de marketing» y «casi en la cima de todas las clasificaciones independientes en una semana» es gran parte de lo que hace que valga la pena entenderlo. Escribo muchos de estos análisis, y la mayoría de las publicaciones sobre modelos nuevos se olvidan rápido porque simplemente repiten una ficha técnica. Esta es diferente en un aspecto que realmente importa a los desarrolladores: los pesos son abiertos bajo una licencia MIT, así que la pregunta habitual —«¿el benchmark es real o es marketing?»— tiene una respuesta inusualmente clara. La gente lo descargó y lo probó por sí misma. Esto es GLM 5.2, así es como funciona y estos son sus límites.

Michael Johnson | 2026-07-15

API de Doubao: la guía completa (2026): qué modelo usar y cómo

API de Doubao: la guía completa (2026): qué modelo usar y cómo

Busca «doubao api» y enseguida te encuentras con un muro. La consola oficial es Volcano Engine, las páginas aparecen en chino por defecto y el registro solicita una verificación de identidad que la mayoría de los desarrolladores fuera de China no puede completar en una tarde. Luego está el problema de los nombres. Doubao, Dola, Cici, Seed, Seedream, Seedance, Volcengine: todos son de ByteDance, y ninguno parece claramente ser aquello que escribiste en el buscador. Escribo guías de integración para GPTProto, y Doubao es la familia de modelos por la que más me preguntan. Así que esta es la guía que me habría gustado encontrar: qué modelo de Doubao sirve para cada tarea, cuánto cuesta realmente cada uno y código listo para copiar y pegar que los invoque —texto, imagen y vídeo— desde un único endpoint, sin necesidad de un número de teléfono chino. Aquí tienes un fotograma producido por el modelo de vídeo Seedance 2.0 a partir de un prompt de texto, invocado mediante la API exactamente como se muestra en el código más adelante. Vamos a llegar hasta él.

Schuyler Stacy | 2026-06-23