Что такое Claude Sonnet 5?
Sonnet 5 — это новейшая модель Anthropic среднего уровня, которую компания представляет как самый агентный Sonnet на данный момент: она планирует действия, управляет браузерами и терминалами и самостоятельно выполняет многоэтапные задачи. Основной посыл Anthropic — соотношение стоимости и производительности — производительность, близкая к Opus 4.8, по ценам Sonnet.
Почему этот акцент важен ещё до обсуждения механики: большую часть прошлого года самые значительные агентные улучшения появлялись на уровне Opus, а не Sonnet. Поэтому команды, выполнявшие агентные задачи в больших объёмах, были вынуждены платить по тарифам Opus за возможности, которые им требовались лишь время от времени. Sonnet 5 — попытка Anthropic перенести часть этих возможностей на более доступный ценовой уровень. В этом и заключается «зачем», что объясняет большинство последующих проектных решений.
Механика, согласно документации Anthropic: это прямая замена Sonnet 4.6, использующая идентификатор модели API claude-sonnet-5, с контекстным окном в 1 млн токенов — одновременно стандартным и максимальным, — и поддержкой до 128 тыс. выходных токенов. На вход подаются текст и изображения, на выходе — текст.
| |
Claude Sonnet 5 |
| Дата выпуска |
30 июня 2026 года |
| Идентификатор модели API |
claude-sonnet-5 |
| Контекстное окно |
1 млн токенов (по умолчанию и максимум) |
| Максимальный вывод |
128 тыс. токенов |
| Ввод / вывод |
Текст + изображение на входе, текст на выходе |
| Связь с 4.6 |
Прямая замена |
Что нового по сравнению с Sonnet 4.6
Если вы уже используете Sonnet 4.6, обновление — это не просто увеличение весов модели. Согласно документации Anthropic, три изменения поведения затронут ваш код:
- Адаптивное мышление включено по умолчанию.
- Ручное расширенное мышление теперь возвращает ошибку 400 (в 4.6 оно уже было объявлено устаревшим).
- Установка параметров сэмплирования — temperature, top_p, top_k — в значения, отличные от стандартных, возвращает ошибку 400.
Ещё два изменения важны с операционной точки зрения. Sonnet 5 предоставляет уровни усилий (low, medium, high и xhigh), при этом более высокий уровень расходует больше токенов на рассуждения, обеспечивая более высокое качество — и большую стоимость. Кроме того, это первая модель уровня Sonnet, в которой по умолчанию включены полноценные киберзащитные механизмы в реальном времени. Перед интеграцией модели в агент стоит знать об одной особенности этих механизмов: когда модель отклоняет помеченный как опасный запрос, отказ возвращается как успешный HTTP 200 с stop_reason: "refusal", а не как ошибка. Если ваша обработка ошибок предполагает, что отказ вызывает исключение, она не сработает.
Однако самое масштабное изменение — то, о котором никто не пишет в заголовках: токенизатор. Я выделяю ему отдельный раздел, потому что он меняет расчёт стоимости.
Ключевые функции и производительность
Anthropic позиционирует Sonnet 5 как безусловное улучшение по сравнению с 4.6 в области рассуждений, использования инструментов, программирования и интеллектуальной работы, а также как модель, достаточно близкую к Opus 4.8, чтобы вы могли выбрать нужную точку на кривой «стоимость — производительность» с помощью регулятора усилий. Конкретные показатели бенчмарков ниже приведены по материалам Anthropic о запуске и публикациям первого дня; считайте точные цифры данными Anthropic, пока сами не ознакомитесь с ними в System Card.
| Бенчмарк |
Sonnet 5 |
Sonnet 4.6 |
Opus 4.8 |
| SWE-bench Pro (агентное программирование) |
63.2% |
58.1% |
69.2% |
| OSWorld-Verified (работа с компьютером) |
81.2% |
78.5% |
— |
| Terminal-Bench 2.1 |
80.4% |
67.0% |
— |
| Humanity's Last Exam (с инструментами) |
57.4% |
46.8% |
57.9% |
| GDPval-AA v2 (интеллектуальная работа) |
1,618 |
— |
1,615 |
Показатели приведены по материалам Anthropic о запуске 30 июня 2026 года; тире обозначают ячейки, которые мне не удалось подтвердить.
Если честно взглянуть на таблицу, сразу бросаются в глаза две вещи. В программировании Sonnet 5 с заметным отрывом превосходит 4.6, но всё ещё уступает Opus 4.8 — разрыв сокращается, но не исчезает. В интеллектуальной работе модель совсем немного превосходит Opus 4.8 (1,618 против 1,615), откуда и взялось повторяемое повсюду утверждение, что она «иногда превосходит Opus»; это правда, но разница минимальна и относится к одному бенчмарку.
Вот о какой стоимости не рассказывают в рекламных материалах. Собственные графики Anthropic показывают, что наилучшее соотношение цены и качества Sonnet 5 демонстрирует при низком и среднем уровне усилий. При переходе на xhigh, согласно сообщениям в день запуска, стоимость может превысить стоимость Opus 4.8 при сопоставимом качестве. Поэтому утверждение «дешевле Opus» нужно воспринимать с оговоркой: дешевле на уровнях усилий, на которых вы действительно обратились бы к Sonnet, но не обязательно при выкручивании регулятора на максимум. Мой вывод: если задаче действительно требуется рассуждение уровня xhigh, сначала рассчитайте стоимость Opus 4.8, а уже потом выбирайте Sonnet 5 — интуитивное представление о том, что меньшая модель всегда дешевле, перестаёт работать на верхнем уровне регулятора.
Что касается безопасности, Anthropic сообщает о более низкой частоте галлюцинаций, лести пользователю и нежелательного поведения по сравнению с 4.6, а также о лучшей устойчивости к вредоносным запросам и атакам через внедрение промптов. Оговорка, которую сама компания публикует: Sonnet 5 по-прежнему демонстрирует более высокую частоту несогласованного поведения, чем Opus 4.8, по результатам внутреннего аудита Anthropic. В сфере кибербезопасности модель ни разу не создала полностью рабочий эксплойт во время тестирования — это намеренно низкий уровень возможностей, что является преимуществом при выпуске пользовательского агента, но ограничением, если ваш сценарий связан с санкционированной работой в сфере безопасности.
Цены Claude Sonnet 5: действительно ли он дешевле?
Цены на витрине — напрямую у Anthropic и по текущему тарифу GPT Proto:
| |
Ввод / 1 млн |
Вывод / 1 млн |
| Sonnet 5 — вводная цена (до 31 августа 2026 года) |
$2 |
$10 |
| Sonnet 5 — стандартная цена (с 1 сентября 2026 года) |
$3 |
$15 |
| Sonnet 5 — через GPT Proto (текущая цена) |
$1.6 |
$8 |
| Sonnet 4.6 |
$3 |
$15 |
| Opus 4.8 |
$5 |
$25 |
При стандартной цене Sonnet 5 стоит столько же за токен, сколько 4.6, и заметно дешевле Opus 4.8. Всё просто. Но цена за токен — это ещё не весь счёт.
Sonnet 5 поставляется с новым токенизатором — тем же, который Anthropic представила вместе с Opus 4.7, — и теперь один и тот же текст преобразуется примерно в 1,0–1,35× больше токенов в зависимости от типа содержимого. Anthropic открыто сообщает об этом в сноске, как и о последствиях: вводная цена установлена так, чтобы переход с 4.6 был примерно нейтральным по стоимости в течение вводного периода. Внимательно прочитайте эту формулировку. Она означает, что стартовая цена $2/$10 — не чистая скидка: отчасти она компенсирует дополнительные токены. А значит, 1 сентября, когда цена вернётся к $3/$15 — на бумаге она будет идентична цене 4.6, — эквивалентный запрос может обойтись дороже, чем в 4.6, поскольку за тот же текст будет выставлено больше токенов.
Итак, дешевле ли Sonnet 5, чем 4.6? Честный ответ: это зависит от того, когда и насколько интенсивно вы его используете. До конца августа — фактически да. После этого при той же нагрузке планируйте стоимость запроса от примерно такой же до немного более высокой, а не более низкой, и измеряйте собственные промпты с новым токенизатором вместо того, чтобы доверять строке с ценой за токен.
Если вы обращаетесь к Claude через GPT Proto, а не напрямую, Sonnet 5 уже доступен на платформе по цене $1.6 / 1 млн входных и $8 / 1 млн выходных токенов — на 20% ниже вводного тарифа Anthropic $2/$10, что делает этот вариант более дешёвым, пока действуют стартовые цены. Для сравнения, на той же платформе Sonnet 4.6 стоит $2.4/$12, а Opus 4.8 — $4/$20. Рабочие вызовы в следующем разделе напрямую обращаются к Sonnet 5.
Как использовать Claude Sonnet 5 через API
Sonnet 5 уже доступен в GPT Proto, поэтому приведённые ниже рабочие примеры напрямую вызывают его на странице модели Claude Sonnet 5. Если вы переходите с 4.6, это именно та прямая замена, которую рекламирует Anthropic: замените claude-sonnet-4-6 на claude-sonnet-5, оставив остальную часть вызова без изменений.
GPT Proto предоставляет Claude в нативном формате Anthropic Messages по адресу https://gptproto.com/v1/messages, используя Bearer-токен. Сначала пример cURL:
curl --request POST "https://gptproto.com/v1/messages" \
--header "Authorization: Bearer $GPTPROTO_API_KEY" \
--header "Content-Type: application/json" \
--header "anthropic-version: 2023-06-01" \
--data '{
"model": "claude-sonnet-5",
"max_tokens": 1024,
"messages": [
{ "role": "user", "content": "Объясните в двух предложениях, что делает агентная модель для программирования." }
]
}'
Тот же вызов на Python, используя только requests:
import os
import requests
resp = requests.post(
"https://gptproto.com/v1/messages",
headers={
"Authorization": f"Bearer {os.environ['GPTPROTO_API_KEY']}",
"Content-Type": "application/json",
"anthropic-version": "2023-06-01",
},
json={
"model": "claude-sonnet-5",
"max_tokens": 1024,
"messages": [
{"role": "user", "content": "Объясните в двух предложениях, что делает агентная модель для программирования."}
],
},
timeout=60,
)
resp.raise_for_status()
data = resp.json()
print(data["content"][0]["text"])
При переходе на Sonnet 5 нужно учесть две вещи. Во-первых, из-за изменения токенизатора меняется количество токенов, а значит, и счёт, и запас, заданный через max_tokens, даже если сам текст не изменился; повторно измерьте показатели, прежде чем считать, что существующие лимиты по-прежнему подходят. Во-вторых, если какой-либо ваш текущий код устанавливает пользовательские значения temperature, top_p или top_k либо включает ручное расширенное мышление, удалите эти параметры: в Sonnet 5 они приводят к ошибке 400.
Один ключ GPT Proto открывает доступ к Claude и ещё более чем 200 моделям с единого баланса, поэтому вы можете сравнить Sonnet 5, например, с более дешёвой моделью в том же потоке запросов, не переключаясь между провайдерами. Полный список доступен в каталоге моделей.
Sonnet 5 против Sonnet 4.6 (и если вы всё ещё используете 4.5 или 3.5)
Вот какое прямое сравнение я бы использовал для принятия решения, оставив Opus 4.8 в качестве ориентира максимального уровня:
| |
Sonnet 5 |
Sonnet 4.6 |
Opus 4.8 |
| Позиционирование |
Агентная работа, близкая к Opus, по цене Sonnet |
Предыдущий стандарт среднего уровня |
Максимальный уровень точности |
| Программирование (SWE-bench Pro) |
63.2% |
58.1% |
69.2% |
| Наилучшее соотношение цены и качества |
Низкий / средний уровень усилий |
— |
Самые сложные задачи |
| Стандартная цена (ввод/вывод на 1 млн) |
$3 / $15 |
$3 / $15 |
$5 / $25 |
| Контекст |
1 млн |
до 1 млн |
200 тыс. |
| Оговорка по стоимости |
Новый токенизатор тарифицирует больше токенов; xhigh может быть дороже Opus |
Привычный токенизатор |
Цена рассчитана на высший уровень |
Мой вывод: если вы используете 4.6 для постоянной агентной работы или программирования, Sonnet 5 стоит протестировать в качестве обновления — улучшения в программировании и использовании инструментов реальны, а вводная цена делает пробный запуск недорогим. Если ваша нагрузка связана с критически важной точностью на самом высоком уровне — с задачами, где ошибка дорого обходится, — оставьте Opus 4.8 в рабочем процессе, а Sonnet 5 используйте для большого объёма задач среднего уровня. И если вы постоянно выбираете уровень xhigh, это сигнал рассчитать стоимость Opus 4.8, а не повод считать Sonnet более дешёвым.
Всё ещё на Sonnet 4.5 или 3.5? Тогда аргументы в пользу обновления ещё сильнее, но я бы не стал приводить вам точный бенчмарк «5 против 3.5», поскольку Anthropic его не публиковала — все приведённые выше показатели сравнивают модель с 4.6. Что можно сказать в общих чертах: между 3.5 и 5 лежат два поколения агентных улучшений, большинство из которых относится именно к использованию инструментов и надёжности при выполнении длительных задач — областям, в которых более старые версии Sonnet не достигали полного результата. Практический шаг одинаков независимо от исходной версии: направьте код на Sonnet 5 в GPT Proto и предоставьте регулятору усилий сделать остальное.
Стоит ли оно того? Честный взгляд
Реакция в первый день оказалась неоднозначной, и это разделение показательно. Положительные отзывы сосредоточились на соотношении цены и возможностей при вводном тарифе. Сомнения возникли вокруг того же вопроса, к которому постоянно возвращается это руководство: сохранится ли преимущество после возвращения стандартной цены $3/$15 и тихого влияния токеновой инфляции нового токенизатора.
Самым полезным сигналом для меня оказался не бенчмарк, а практический обзор команды, разрабатывающей инструменты для проверки кода, которая протестировала модель на реальной работе. Их вывод работает в обе стороны, поэтому я ему доверяю: при написании и создании кода Sonnet 5 оказалась самой сильной моделью, которую они использовали в этом ценовом сегменте. При проверке кода это был компромисс — комментарии стали чище и точнее, но модель находила меньше ошибок, чем уже используемые в продакшене модели, при немного большей стоимости одной проверки. Команда также заметила два поведения, которые повышают продуктивность в агентных циклах: модель обычно пишет тесты до реализации функции и переписывает собственный план в середине длительной задачи, вместо того чтобы продолжать следовать устаревшему плану. Отмеченная ими проблема совпадает с собственной оговоркой Anthropic — новые киберзащитные механизмы иногда срабатывают на легитимных задачах в сфере безопасности.
Стоит помнить: восторженные цитаты в публикации о запуске принадлежат партнёрам Anthropic, получившим ранний доступ. Они настоящие, но отобраны специально, а отзывы, выбранные поставщиком самостоятельно, не являются нейтральным свидетельством. Независимый практический вывод — модель сильна в генерации, но слабее и дороже при проверке — служит более честной отправной точкой.
Кому стоит перейти? Командам, занимающимся большим объёмом программирования, использованием инструментов, автоматизацией браузера и терминала или интеллектуальной работой, за которую они переплачивали при использовании Opus, — стоит перейти и сделать это во время вводного периода, пока тестирование обходится дёшево. Командам, чей основной процесс связан с тщательной проверкой или решениями, критичными к точности, — стоит протестировать модель, но не отказываться от текущей модели в день запуска и повторно провести собственный набор оценок перед окончательным переходом.
Итог: Sonnet 5 — это настоящее улучшение для агентной работы и программирования, а вводная цена делает пробный запуск недорогим. Только не воспринимайте формулировку «та же цена, что у 4.6» как «тот же счёт» и рассчитайте стоимость Opus 4.8, прежде чем выкручивать регулятор усилий на максимум. Сегодня вы можете вызывать Claude Sonnet 5 через GPT Proto по цене $1.6 / $8 — на 20% ниже стартового тарифа Anthropic — с единым балансом и одним API-ключом, а при необходимости направлять чувствительные к стоимости запросы к другим моделям из 200+ моделей.