Claude Opus 5 и Fable 5: краткое сравнение
| Категория |
Claude Opus 5 |
Claude Fable 5 |
| Дата выпуска |
24 июля 2026 г. |
9 июня 2026 г. |
| Официальная цена API |
$5/млн входных, $25/млн выходных |
$10/млн входных, $50/млн выходных |
| Доступность в GPT Proto |
Недоступна на момент публикации |
Доступна по цене $8/млн входных, $40/млн выходных |
| Контекстное окно |
1 млн токенов |
1 млн токенов |
| Максимальный объём вывода |
128 тыс. токенов |
128 тыс. токенов |
| Входные данные и вывод |
На входе текст и изображения; на выходе текст |
На входе текст и изображения; на выходе текст |
| Рассуждения |
Адаптивное мышление; регулируемая интенсивность |
Адаптивное мышление всегда включено; регулируемая интенсивность |
| Сравнительная задержка |
Средняя |
Более высокая |
| Надёжная дата отсечения знаний |
Май 2026 г. |
Январь 2026 г. |
| Идентификатор модели |
claude-opus-5 |
claude-fable-5 |
| Оптимальный сценарий |
Сложное программирование и корпоративная работа |
Агентная работа максимальной сложности с длительным выполнением |
| Главный недостаток |
При высокой интенсивности может расходовать значительно больше токенов |
Вдвое более высокая официальная цена токенов, более строгие ограничения |
Спецификации взяты из актуального сравнения моделей Anthropic. Таблица показывает, почему это сравнение не является обычным противостоянием «премиальной модели и более дешёвой модели»: размер контекста, максимальный объём вывода и поддерживаемые модальности одинаковы. Преимущества Fable связаны с качеством суждений и надёжностью при долгосрочной работе, а не с большим контекстным окном или функцией, недоступной Opus.
Что на самом деле говорят бенчмарки
Главный тезис запуска верен, но ему не хватает одного слова: Opus 5 примерно так же производительна, как Fable 5, при вдвое меньшей стоимости токенов. Она не превосходит её во всех задачах.
Artificial Analysis оценила Opus 5 при максимальной интенсивности в 61 балл по своему Intelligence Index — на один балл выше Fable 5 с результатом 60. Преимущество в один балл следует считать фактической ничьей, а не доказательством того, что более дешёвая модель выигрывает в каждой задаче. Более интересные результаты видны в агентной работе:
| Независимая оценка |
Результат Opus 5 |
Сравнение с Fable 5 |
| Artificial Analysis Intelligence Index |
61 при максимальной интенсивности |
60 |
| GDPval-AA v2 |
1 861 Elo при максимальной интенсивности |
Opus опережает на 114 Elo |
| AA-Briefcase |
1 720 Elo при максимальной интенсивности |
Fable набирает 1 574 |
| Terminal-Bench v2.1 |
89% при максимальной интенсивности |
Opus близка к общему лидеру |
| Humanity’s Last Exam |
53% |
Примерно на одном уровне с Fable |
AA-Briefcase особенно полезен, поскольку проверяет агентов на частных реалистичных задачах, связанных с тысячами файлов и такими результатами, как отчёты, презентации и электронные таблицы. Opus 5 не просто немного опередила Fable при максимальной интенсивности. В режиме высокой интенсивности она набрала 1 606 Elo — на 32 пункта больше Fable — при средней стоимости $10.41 за задачу против $22.30 у Fable. Artificial Analysis сообщает, что Opus при максимальной интенсивности стоила $17.79 за задачу и всё равно превзошла результат Fable.
Есть и цена. Три верхних уровня интенсивности Opus в среднем требовали более 25 минут на задачу AA-Briefcase. При максимальной интенсивности среднее время составляло 36,2 минуты и 103 шага. Иными словами, Opus может достичь более высокого потолка, работая дольше и выполняя больше шагов. Дешёвые токены не делают агентов с высокой интенсивностью мгновенными.
Fable также сохраняет измеримое преимущество в фактических знаниях. В AA-Omniscience Opus повысила точность по сравнению с Opus 4.8, но чаще отвечала в ситуациях неуверенности, что привело к 50%-ному уровню галлюцинаций в этом конкретном тесте. Это не означает, что половина всех ответов Opus 5 — галлюцинации. Это означает, что в рамках методологии AA-Omniscience её готовность отвечать на неподтверждённые вопросы привела к более высокой доле ошибок, чем у Fable.
Важна ещё одна оговорка: Artificial Analysis проводила оценку Opus и Fable с включённым резервным переходом на Opus 4.8. Это измеряет конфигурацию готовой к развёртыванию системы, но делает результат несколько менее чистым как сравнение только моделей.
Вывод уже, чем рекламные заявления при запуске: Opus 5 сейчас предлагает лучшее соотношение возможностей и стоимости. Fable остаётся более безопасным кандидатом, когда фактическая сдержанность и сложные долгосрочные суждения важнее среднего результата в бенчмарках.
Claude Opus 5 и Fable 5 для программирования
«Какая модель лучше пишет код?» — неправильный вопрос. Агенту для программирования нужно понять репозиторий, диагностировать проблему, выбрать направление, написать исправление, запустить тесты и распознать, когда его первая теория оказалась неверной. Модель может создавать чистый код и при этом направить проект не в ту сторону.
Диагностика и планирование
Именно здесь ранние свидетельства сообщества расходятся.
В одном сравнении отладки в рабочей среде в день запуска разработчик дал нескольким моделям Claude одинаковый одноразовый запрос на основе ранее решённой проблемы. Opus 5 была единственной моделью, которая определила точный компонент, содержащий первопричину; Fable нашла правильную общую категорию, но не смогла указать конкретику. Автор прямо отметил, что это был один тест с размером выборки один.
Другой разработчик сообщил почти о противоположном опыте. В проекте годичной давности, протестированном с Opus 5 и Fable 5, Opus писала качественный код, но неоднократно делала неверный вывод о флаге конфигурации. Позже Fable обнаружила дополнительные проблемы в рассуждениях Opus. Предложенный этим разработчиком рабочий процесс оказался показательным: использовать Fable для планирования и оркестрации, а затем Opus для ограниченной реализации.
Ни один из этих постов не является контролируемым бенчмарком. Оба полезнее общих похвал, потому что показывают реальную границу отказа. Похоже, Opus способна на более точную одношаговую диагностику, но также может слишком быстро закрепиться на определённой теории. Ценность Fable не в более красивом коде, а в возможности избежать дорогостоящих неверных поворотов.
Написание и рефакторинг кода
Здесь Opus 5 — более сильный вариант по умолчанию. Anthropic позиционирует её для сложного агентного программирования, а независимое тестирование ставит Opus вместе с Claude Code на первое место в Artificial Analysis Coding Index. Anthropic также сообщает о сложных случаях, в которых модель находила первопричину, а не исправляла симптом, создавала собственный набор проверок при отсутствии доступной онлайн-ленты и проверяла результат в браузере перед передачей работы. Это примеры, отобранные поставщиком, поэтому их следует воспринимать как демонстрацию возможностей, а не как ожидаемую долю успеха. Тем не менее они описывают правильное поведение, которое стоит проверять.
Для ограниченных задач — реализовать эту функцию, отрефакторить эти файлы, исправить эти неудачные тесты — более низкая цена Opus упрощает обоснование повторных запусков и проверок. Fable может выполнить ту же работу, но платить вдвое больше за токены имеет смысл только в том случае, если это достаточно сокращает количество шагов, доработок или участия человека, чтобы компенсировать разницу.
Проверка итоговой реализации
Не позволяйте ни одной из моделей проверять саму себя.
Дайте обеим моделям один и тот же зафиксированный коммит, задачу, инструменты, ограничение по времени и определение готовности. Затем оценивайте результаты, выдерживающие проверку:
| Этап тестирования |
Что дать обеим моделям |
Что измерять |
| Диагностика |
Репозиторий только для чтения, журналы, известный инцидент |
Правильная первопричина, неподтверждённые утверждения, указанные файлы |
| Реализация |
Одна и та же проблема, доступные для записи инструменты, одинаковые тесты |
Пройденные тесты, регрессии, повторные попытки, изменённые файлы |
| Проверка |
Скрытые крайние случаи и критерии приёмки |
Пропущенные ошибки, ложные заявления «готово», исправления человека |
Для важной миграции разумным будет рабочий процесс, в котором Fable составляет первоначальный план, Opus выполняет реализацию, а отдельная модель или человек проверяет результат. Это дороже, чем один запуск Opus. Но всё равно может оказаться дешевле, чем утверждение неправильной архитектуры.
Цены Opus 5 и Fable 5 и реальная стоимость задач
По официальным тарифам API Opus 5 стоит $5 за миллион входных токенов и $25 за миллион выходных. Fable 5 стоит $10 и $50. Соотношение точное: Fable вдвое дороже за токен. Эти тарифы указаны в анонсе Opus 5 Anthropic и руководстве по интеграции Fable 5.
Для рабочей нагрузки, использующей 10 млн входных токенов и 2 млн выходных токенов:
| Маршрут |
Стоимость входных данных |
Стоимость выходных данных |
Итого |
| Opus 5 по официальной цене |
$50 |
$50 |
$100 |
| Fable 5 по официальной цене |
$100 |
$100 |
$200 |
| Fable 5 в GPT Proto |
$80 |
$80 |
$160 |
На странице API GPT Proto для Fable 5 сейчас указана цена $8 за миллион входных токенов и $40 за миллион выходных. В приведённом примере не учитываются кэширование, скидки за пакетную обработку, повторные попытки, резервные переходы и контекст, созданный инструментами, чтобы сравнение оставалось понятным.
Цена токенов — лишь первая строка счёта. Opus 5 предлагает пять уровней интенсивности — low, medium, high, xhigh и max, — и Artificial Analysis наблюдала примерно восьмикратный диапазон использования выходных токенов между low и max в GDPval-AA v2. Команда, которая отправляет каждый запрос автодополнения, извлечения данных и небольшого изменения кода в режим максимальной интенсивности, может потерять часть ожидаемой экономии.
Лучший показатель — стоимость успешно выполненной задачи:
стоимость успешно выполненной задачи =
общие расходы на модель
+ расходы на повторные попытки и резервные переходы
+ время человека на проверку
÷ принятые задачи
В AA-Briefcase Opus при высокой интенсивности превзошла Fable и при этом стоила менее половины от её стоимости за задачу. Это весомый аргумент в пользу Opus. Но это не гарантия для вашего репозитория. Если Fable предотвратит одну неудачную миграцию, которую Opus одобрила бы, дорогая модель может оказаться более дешёвым решением.
В каких случаях Fable 5 всё ещё лучше
За Fable 5 по-прежнему стоит платить, когда задача длительная, неоднозначная и дорогая для перезапуска.
Во-первых, Anthropic по-прежнему называет Fable 5 своей наиболее производительной широко доступной моделью и рекомендует её для рабочих нагрузок, требующих максимальных доступных возможностей. Opus — рекомендуемая отправная точка; Fable — путь эскалации. Это различие намеренно.
Во-вторых, более осторожное поведение Fable может помочь при планировании, фактических исследованиях и работе с незнакомыми системами. Доступный независимый результат по фактическим знаниям говорит в пользу Fable, а негативный отчёт сообщества об Opus описывает именно тот тип ошибки, который таблицы бенчмарков могут скрыть: внешне корректный код, построенный на ложном выводе.
В-третьих, Fable создавалась для длительно работающих агентов. Anthropic позиционирует её для требовательных рассуждений, многодневных проектов и автономной работы, охватывающей множество этапов. Часовая задача программирования может не выявить её преимущество. Трёхдневная миграция с сотнями решений — вполне.
Документированные компромиссы интеграции существенны:
-
Официальные цены Fable на входные и выходные токены вдвое выше, чем у Opus 5.
-
Anthropic классифицирует сравнительную задержку Fable как более высокую.
-
Адаптивное мышление Fable всегда включено, хотя его интенсивность всё ещё можно регулировать.
-
Для Fable требуется 30-дневное хранение данных, и она недоступна в режиме нулевого хранения данных.
-
Её классификаторы безопасности могут возвращать stop_reason: "refusal" в ответе HTTP 200, поэтому рабочим интеграциям нужны обработка отказов и логика резервного перехода.
Fable — не «лучшая модель, если бюджет не имеет значения». Это специализированный инструмент для случаев, когда качество планирования, фактическая сдержанность или стабильность на длинной дистанции оправдывают измеримую переплату.
Различия для разработчиков, которые не отражают таблицы бенчмарков
| Деталь интеграции |
Opus 5 |
Fable 5 |
Почему это важно |
| Управление интенсивностью |
Low, medium, high, xhigh, max |
Адаптивное мышление всегда включено; управление интенсивностью поддерживается |
Интенсивность влияет на задержку и расход токенов |
| Дата отсечения знаний |
Май 2026 г. |
Январь 2026 г. |
Opus может знать более свежие библиотеки и API |
| Классификаторы безопасности |
Менее строгие, чем у Fable |
Более строгие, особенно в кибербезопасности и биологии |
Для безобидных запросов по безопасности или отладке может понадобиться резервный маршрут |
| Обработка отказов |
Доступен резервный переход |
HTTP 200 может содержать stop_reason: "refusal" |
Успешный статус HTTP не всегда означает завершённую задачу |
| Хранение данных |
Для общего доступа нет специального требования к хранению на уровне модели |
Требуется хранение в течение 30 дней |
Важно для регулируемых или конфиденциальных рабочих нагрузок |
| Сравнительная задержка |
Средняя |
Более высокая |
Агентные циклы увеличивают задержку с каждым шагом |
| Быстрый режим |
Примерно в 2,5× быстрее стандартного режима при двукратной базовой цене токенов |
Эквивалентный вариант при запуске не указан |
Полезен, когда задержка важнее стоимости |
Anthropic утверждает, что киберклассификаторы Opus 5 должны вмешиваться примерно на 85% реже, чем классификаторы Fable 5. Это делает Opus более практичной моделью Claude для многих легитимных рабочих процессов, связанных с безопасностью кода и отладкой, хотя она по-прежнему блокирует категории повышенного риска. В той же документации о запуске говорится, что для Opus 5 нет специального требования к хранению данных на уровне модели при общем доступе, тогда как руководство по интеграции Fable указывает 30-дневное хранение.
Миграция требует не только изменения идентификатора модели. В Opus 5 рассуждения включены по умолчанию, и приложениям следует явно задавать интенсивность, если важны стоимость или задержка. Fable всегда рассуждает и может возвращать отказы в ответах HTTP, которые выглядят как завершённые. Переключение без обновления парсеров, правил резервного перехода, бюджетов токенов и порогов оценки — приглашение к скрытым сбоям.
А как насчёт Claude Opus 5 и Kimi K3?
Kimi K3 не является прямой заменой Claude, но это наиболее важный третий вариант, когда решение определяется стоимостью и агентной работой с длинным контекстом.
Kimi K3 от Moonshot имеет контекстное окно в 1 млн токенов, принимает на вход текст, изображения и видео и использует постоянно включённые рассуждения. Официальная цена составляет $3 за миллион входных токенов и $15 за миллион выходных. На странице API Kimi K3 в GPT Proto сейчас указаны цены $2.70 и $13.50 — ниже, чем у обеих моделей Claude.
Это не делает Kimi автоматическим победителем по стоимости. Долгосрочные рассуждения могут порождать больше шагов, сохраняемой истории рассуждений и выходных токенов. Измеряйте стоимость завершённой задачи, а не число на ценнике.
Возможности также остаются ниже в доступном на момент запуска широком независимом сравнении: Artificial Analysis оценила Kimi K3 в 57 баллов против 61 у Opus 5 и 60 у Fable 5. Тем не менее Kimi стоит включить в список кандидатов для мультимодальных агентных рабочих процессов, особенно когда важны входные видео или более низкие тарифы на токены.
Есть одна деталь статуса, с которой нужно быть аккуратным. Moonshot сообщает, что полные веса Kimi K3 будут выпущены к 27 июля 2026 г. По состоянию на 25 июля точное описание — «запланирована к выпуску с открытыми весами», а не «уже доступна для скачивания и полностью открыта».
Выбирайте Kimi K3, если вам нужна доступная мультимодальная модель по более низкой цене и вы готовы проверить её агентное поведение. Выбирайте Opus, если хотите лучший текущий вариант по умолчанию. Выбирайте Fable, если задача оправдывает переход на общедоступный уровень Anthropic с максимальными возможностями.
Какую модель выбрать?
| Ваша рабочая нагрузка |
Лучший текущий выбор |
Почему |
| Повседневная работа в Claude Code, рефакторинг и разработка функций |
Opus 5 |
Лучший баланс возможностей и стоимости |
| Сложная отладка с известным и проверяемым результатом |
Сначала Opus 5; сравните с Fable |
Opus демонстрирует высокий потенциал поиска первопричин, но выводы нужно проверять |
| Автономный проект на несколько дней |
Fable 5 |
Создана и позиционируется для долгосрочной работы |
| Планирование архитектуры с высокой ценой ошибки |
Fable 5 |
Более оправданная переплата за качество суждений и сдержанность |
| Регулируемый рабочий процесс, чувствительный к хранению данных на уровне модели |
Opus 5 |
Для Fable требуется хранение в течение 30 дней |
| Легитимная отладка в сфере кибербезопасности |
Opus 5 |
Классификаторы менее строгие, чем у Fable |
| Чувствительный к стоимости мультимодальный агент, которому нужен ввод видео |
Kimi K3 |
Более низкие тарифы и заявленная поддержка понимания видео |
| Нужна модель, доступная через GPT Proto прямо сейчас |
Fable 5 или Kimi K3 |
Opus 5 ещё не представлена на момент публикации |
Если сегодня можно выбрать только одну модель, выбирайте Opus 5. Если приложение умеет распределять задачи по маршрутам, используйте Opus по умолчанию, а самые сложные задачи планирования или длительные процессы отправляйте в Fable. Так переплата за Fable будет применяться только к работе, которая действительно может получить от неё пользу.
Протестируйте Fable 5 и Kimi K3 в GPT Proto
На момент публикации Opus 5 была недоступна в GPT Proto, поэтому её не следует представлять как активный вариант. Fable 5 и Kimi K3 уже можно протестировать с одной учётной записью GPT Proto и общим балансом, а затем сравнить их ответы на одной и той же задаче и по одинаковым критериям приёмки.
Вызовите Fable 5 через endpoint Messages:
curl --request POST "https://gptproto.com/v1/messages" \
--header "Authorization: Bearer $GPTPROTO_API_KEY" \
--header "Content-Type: application/json" \
--data '{
"model": "claude-fable-5",
"max_tokens": 2048,
"messages": [
{
"role": "user",
"content": "Проверьте этот план миграции. Укажите неподтверждённые предположения, отсутствующие шаги отката и тесты, необходимые до выхода в продакшен."
}
]
}'
Вызовите Kimi K3 через совместимый с OpenAI endpoint Chat Completions:
curl "https://gptproto.com/v1/chat/completions" \
--header "Content-Type: application/json" \
--header "Authorization: $GPTPROTO_API_KEY" \
--data '{
"model": "kimi-k3",
"messages": [
{
"role": "user",
"content": "Проверьте этот план миграции. Укажите неподтверждённые предположения, отсутствующие шаги отката и тесты, необходимые до выхода в продакшен."
}
]
}'
Используйте одинаковые запрос, файлы, разрешения инструментов и систему оценки. Записывайте количество входных и выходных токенов, время выполнения, неподтверждённые утверждения, повторные попытки и число исправлений человека до принятия результата. Побеждает не модель, которая пишет самый уверенный первый ответ, а та, которая выполняет вашу задачу.
Начать можно с унифицированного AI API GPT Proto или открыть галерею AI-моделей, чтобы сравнить другие модели для программирования и рассуждений в рамках одной учётной записи.
Итоговый вердикт
Claude Opus 5 — лучшая модель по умолчанию. Она не уступает Fable 5 или превосходит её в нескольких важных независимых оценках, стоит вдвое дешевле за токен по официальным тарифам, работает с меньшей сравнительной задержкой и предоставляет разработчикам более широкий практический диапазон настроек интенсивности.
Fable 5 не устарела. Теперь её проще оправдать как специализированный инструмент, а не вариант по умолчанию: используйте её для самых сложных длительных агентных задач, критически важного планирования и работы, где один неверный вывод может стоить дороже всего счёта за API.
Проще говоря: Opus 5 — модель, с которой следует начинать большинству команд. Fable 5 — модель, на которую следует переходить для более сложных задач.