Что такое GLM-5.3?
GLM-5.3 — новейшая модель, ориентированная на кодинг, доступная через подписочный тарифный план Z.ai GLM Coding Plan. Z.ai, ранее известная как Zhipu AI, разрабатывает китайское семейство языковых, визуальных, графических, видеомоделей и моделей-агентов GLM.
Текущая официальная документация позиционирует GLM-5.3 для агентов кодинга, а не для обычного браузерного чата. Разработчики могут выбрать её в инструментах, поддерживающих пользовательские модели, включая Claude Code, Goose, Codex и Cline. Z.ai также сообщает, что запросы Coding Plan, направленные по прежним маршрутам glm-5.2 и glm-5.1, теперь автоматически перенаправляются на GLM-5.3.
Вот что можно подтвердить сегодня:
| Пункт |
Подтверждённый статус GLM-5.3 |
| Разработчик |
Z.ai, ранее Zhipu AI |
| Текущая доступность |
Доступна в Z.ai GLM Coding Plan |
| Идентификатор модели |
glm-5.3 |
| Идентификатор расширенного контекста |
glm-5.3[1m] |
| Параметр контекста |
До 1 миллиона токенов через конфигурацию [1m] |
| Усилия рассуждения |
Low, high и max; по умолчанию используется max |
| Прямой ввод изображений |
Отключён в текущей конфигурации Cline |
| Стандартная цена API |
Не опубликована |
| Открытые веса и лицензия |
Не опубликованы |
| Официальные или независимые бенчмарки |
Не опубликованы |
| Доступность GPT Proto |
В настоящее время недоступна |
Эта таблица намеренно короче спекулятивных спецификаций GLM-5.3, распространяющихся в интернете. Архитектура, количество параметров, результаты бенчмарков и лицензия на открытые веса остаются неизвестными. Перенос этих сведений из GLM-5.2 сделал бы таблицу более впечатляющей, но одновременно неверной.
Выпущена ли GLM-5.3? Дата выпуска и статус предварительной версии
GLM-5.3 выпущена в рамках одного продукта — GLM Coding Plan. В руководстве Z.ai по переключению моделей теперь отображается сообщение «GLM-5.3 уже доступна», а также говорится, что подписчики Lite, Pro и Max могут переключиться на неё.
Точной даты выпуска GLM-5.3 по-прежнему нет. В общих примечаниях к выпускам моделей Z.ai пока отсутствует датированная запись о GLM-5.3, а на страницах стандартного обзора моделей и цен за токены по-прежнему на первом месте находится GLM-5.2. Поэтому безопаснее всего описывать это как тихий запуск в рамках Coding Plan, а не как полноценный публичный релиз.
Это также меняет понимание термина «предварительная версия GLM-5.3». До обновления документации GLM-5.3 фактически была ключевым словом для отслеживания выпуска, поддерживаемым обсуждениями сообщества. Теперь это вызываемая модель Coding Plan с официальным идентификатором. Неполной остаётся документация о модели, а не её существование в рамках тарифа.
Для производственных команд этот пробел важен. Маршрут может быть доступен для вызова ещё до того, как станут известны его архитектура, стоимость вне подписки, ограничения пропускной способности, независимое качество и условия самостоятельного развёртывания. Доступность отвечает на вопрос «Могу ли я её протестировать?», но пока не отвечает на вопрос «Стоит ли заменять ею производственную модель?»
Какие функции GLM-5.3 подтверждены?
Опциональный контекст на 1 миллион токенов
Z.ai документирует glm-5.3[1m] для разработчиков, которым нужен контекст на 1 миллион токенов. В Claude Code настройка также требует установить CLAUDE_CODE_AUTO_COMPACT_WINDOW в значение 1000000.
Суффикс имеет значение. Разработчикам не следует считать, что каждый запрос с обычной строкой glm-5.3 автоматически получает такую же конфигурацию контекста. Длинное контекстное окно важно для больших репозиториев, длинных историй работы агентов, планов миграции и задач отладки нескольких файлов. Цена — большее потребление контекста и потенциально более длительные циклы рассуждения.
Миллион токенов также не гарантирует, что модель одинаково хорошо запомнит каждую зависимость. Ёмкость контекста показывает, сколько данных можно передать. Точность извлечения, сохранение ограничений и стабильность циклов работы с инструментами всё ещё требуют тестирования на уровне задач.
Низкий, высокий и максимальный уровень усилий рассуждения
GLM-5.3 Coding Plan преобразует различные настройки инструментов в три фактических уровня усилий:
| Запрошенная настройка |
Используемый уровень усилий GLM-5.3 |
minimal, light, или low |
Low |
medium или high |
High |
xhigh, max или ultra |
Max |
| Отсутствующая или неизвестная настройка |
По умолчанию — Max |
Низкий уровень усилий — разумная отправная точка для небольших изменений и простых вопросов. High — промежуточный вариант. Max предназначен для сложного кодинга и работы агентов, где глубокое рассуждение важнее стоимости ответа или задержки.
Официальный бенчмарк GLM-5.3 пока не измеряет разницу между этими настройками. Рассматривайте уровень усилий как переменную для тестирования, а не как гарантию качества. Более полезный производственный показатель — стоимость одной принятой задачи после повторных попыток, а не то, выполнялся ли каждый запрос на максимальном уровне.
Совместимость с агентами кодинга
В официальном руководстве по переключению перечислены три способа доступа:
Claude Code и Goose используют совместимый с Anthropic эндпоинт.
Codex использует эндпоинт /api/v1 Z.ai.
Cline и другие совместимые инструменты могут использовать эндпоинт кодинга в стиле OpenAI.
Это наиболее ясный сигнал о текущем назначении GLM-5.3. Модель распространяется для генерации кода, отладки, вопросов о репозиториях и длительных задач агентов, а не как новый мультимодальный ассистент для потребителей.
Доступ прежде всего к тексту, а обработка изображений — отдельно
Z.ai рекомендует пользователям Cline отключить функцию «Поддержка изображений» при настройке glm-5.3. Отдельно Coding Plan предлагает понимание изображений через визуальный MCP-сервис.
Проще говоря, текущий прямой маршрут GLM-5.3 следует считать предназначенным для текстового ввода и кода. Скриншот может попасть в более широкий рабочий процесс Z.ai через другой сервис, но это не доказывает, что базовая модель glm-5.3 нативно принимает изображения.
Это один из крупнейших пробелов в ранних материалах о GLM-5.3. Спрос сообщества на поддержку изображений действительно существует. Однако запрос на функцию — не то же самое, что выпущенная модальность.
GLM-5.3 против GLM-5.2: что действительно обновилось?
Самое заметное подтверждённое обновление — маршрутизация: GLM-5.3 теперь является текущей моделью по умолчанию внутри Coding Plan, а прежние запросы к GLM-5.2/5.1 автоматически направляются на неё. Z.ai пока не опубликовала достаточно технических данных, чтобы количественно оценить улучшение качества.
| Область |
GLM-5.2 |
GLM-5.3 |
| Позиция в Coding Plan |
Предыдущая модель |
Текущая модель |
| Идентификатор модели |
glm-5.2 |
glm-5.3 |
| Контекст |
Задокументирован 1M |
Опция 1M задокументирована |
| Конфигурация рассуждения |
Гибкий уровень усилий |
Low, high и max задокументированы |
| Архитектура |
744B всего, 40B активных параметров MoE |
Не раскрыта |
| Открытые веса |
Доступны под лицензией MIT на Hugging Face |
Не опубликованы |
| Стандартная цена API Z.ai |
$1,40 за вход / $4,40 за выход на 1 млн токенов |
Не опубликована |
| Опубликованные результаты кодинга |
Доступны от Z.ai |
Для версии 5.3 не опубликованы |
| Прямая конфигурация изображений |
Прежде всего текстовая |
Поддержка изображений отключена в текущей настройке |
В репозитории GLM-5 Z.ai сообщает, что GLM-5.2 набрала 81,0 балла в Terminal-Bench 2.1 и 62,1 балла в SWE-bench Pro. Также сообщается, что IndexShare снизил количество FLOPs на токен в 2,9 раза при контексте в 1 миллион токенов, а изменения в спекулятивном декодировании увеличили длину принятой последовательности до 20%.
Это результаты GLM-5.2, предоставленные поставщиком. Они дают базовую точку, но не являются свидетельством по GLM-5.3. Мы пока не знаем, меняет ли версия 5.3 архитектуру, добавляет ли новые обучающие данные, улучшает ли вызов инструментов, сокращает ли цепочки рассуждений или просто представляет собой более новую версию постобучения, обслуживаемую в том же семействе.
Стоит исправить ещё одну неточность: в некоторых ранних статьях GLM-5.2 называют моделью с 753 миллиардами параметров. В текущем репозитории и таблице загрузок Z.ai она указана как 744B-A40B. При сравнении с предшественницей безопаснее использовать официальную цифру.
Разработчики, которым нужна документированная и доступная сейчас модель того же семейства, могут использовать GLM-5.2 API на GPT Proto, пока ждут проверенный маршрут GLM-5.3.
Цены GLM-5.3: сколько это стоит?
На вопрос о цене GLM-5.3 есть два разных ответа — в зависимости от того, означает ли «цена» подписку Coding Plan или стандартный API с оплатой за токены.
Подписка GLM Coding Plan
В документации Z.ai указано, что доступ по подписке начинается с $18 в месяц. На момент проверки на публичной странице подписки отображались промо-цены $12,60 для Lite, $56 для Pro и $117,60 для Max по сравнению с обычными ценами $18, $80 и $168. Промоакции могут меняться, поэтому перед планированием бюджета следует проверить цену при оформлении.
| Тариф |
Кредиты на пять часов |
Недельные кредиты |
| Lite |
2 000 |
10 000 |
| Pro |
12 000 |
60 000 |
| Max |
28 000 |
140 000 |
Все три тарифа поддерживают GLM-5.3. Max не предоставляет отдельную модель «GLM-5.3 Max» — он даёт больший лимит использования.
Расход кредитов GLM-5.3
В обзоре Coding Plan для GLM-5.3 указаны следующие множители кредитов:
| Тип использования |
Множитель кредитов |
| Входные токены |
6.9 |
| Кэшированные входные токены |
1.7 |
| Выходные токены |
24 |
В документированные периоды низкой нагрузки Z.ai взимает половину стандартного количества кредитов. Это может существенно изменить объём работы, поддерживаемый подпиской, но кредиты — не доллары. Преобразование этих множителей в вымышленную цену за миллион токенов смешало бы две системы расчётов.
Стандартная цена токенов API
Z.ai не указала GLM-5.3 на своей странице стандартных цен API. Сейчас на странице указана цена GLM-5.2: $1,40 за миллион входных токенов, $0,26 за миллион кэшированных входных токенов и $4,40 за миллион выходных токенов.
Не применяйте эти цены к GLM-5.3. Они полезны только как ориентир для предшественницы.
Является ли «GLM-5.3 Max» отдельной моделью?
В настоящее время ни один официальный источник не указывает на отдельную модель под названием GLM-5.3 Max.
Слово «Max» встречается в двух разных контекстах. Во-первых, Max — высший уровень подписки GLM Coding Plan, предоставляющий 28 000 кредитов за пят часов и 140 000 кредитов в неделю. Во-вторых, max — самый глубокий задокументированный уровень усилий рассуждения для glm-5.3.
Поэтому запрос вроде «GLM-5.3 Max против GLM-5.2 Max» обычно означает сравнение обеих версий на максимальном уровне усилий рассуждения. Он не подтверждает существование двух отдельных моделей с брендом Max.
Надёжно провести такое сравнение пока нельзя. Для GLM-5.2 опубликованы результаты поставщика и независимые результаты, а для GLM-5.3 — нет. Честный тест потребовал бы одинаковой настройки агента, набора задач, контекста, уровня усилий, политики повторных попыток и критериев принятия. Сравнение одного отшлифованного демо 5.3 со старым бенчмарком 5.2 мало что нам скажет.
GLM-5.3 против Kimi K3 и Claude Fable 5
GLM-5.3 уже обсуждают наряду с Kimi K3 и Claude Fable 5, поскольку все три модели предназначены для сложного кодинга или работы с длинным контекстом. Однако доступные для них доказательства неравноценны.
Поэтому в запросах «GLM-5.3 против Kimi K3» или «GLM-5.3 против Fable 5» пока нет победителя, подтверждённого фактами.
| Модель |
Состояние выпуска |
Контекст |
Ввод изображений |
Стандартная цена за 1 млн токенов |
Публичные независимые результаты |
| GLM-5.3 |
Доступна в Coding Plan; сведения о полном выпуске неполны |
Опция 1M |
Отключена в текущей прямой конфигурации |
Не опубликована |
Пока недоступны |
| GLM-5.2 |
Полностью выпущена с открытыми весами |
1M |
Нет |
$1,40 за вход / $4,40 за выход |
Доступны |
| Kimi K3 |
Полностью выпущена |
1M |
Да |
$3 за вход / $15 за выход |
Доступны |
| Claude Fable 5 |
Полностью выпущена, проприетарная |
1M |
Да |
$10 за вход / $50 за выход |
Доступны |
Согласно независимому тестированию, Kimi K3 получила 60 баллов в Artificial Analysis Intelligence Index. Тот же источник указывает на поддержку текстового и графического ввода, контекст в 1 миллион токенов и архитектуру MoE с 2,8 триллиона параметров, из которых 104 миллиарда активны. В официальной документации Anthropic цена Claude Fable 5 указана как $10 за миллион входных токенов и $50 за миллион выходных, а размер контекста составляет 1 миллион токенов.
В текущем рейтинге кодинга LMArena также присутствуют Kimi K3 и Fable 5. GLM-5.3 пока не добавлена. Пока модель не появится в воспроизводимых оценках, утверждения о том, что GLM-5.3 превосходит любую из них, являются прогнозами, а не сравнением.
Для разработчиков, выбирающих модель сегодня:
Выбирайте GLM-5.2, если важнее всего открытые веса и более низкая документированная стоимость токенов.
Выбирайте Kimi K3, если вам нужны контекст 1M, ввод изображений и высокие результаты кодинга, подтверждённые независимыми измерениями.
Выбирайте Fable 5, если высший задокументированный уровень Anthropic важнее стоимости токенов.
Тестируйте GLM-5.3, если у вас уже есть Z.ai Coding Plan, но сохраняйте резервную модель, пока её поведение и расчёты не будут соответствовать вашей рабочей нагрузке.
GPT Proto сейчас предоставляет доступ к API Kimi K3 по цене $2,70 за миллион входных и $13,50 за миллион выходных токенов. Claude Fable 5 также доступна по цене $8 за вход и $40 за выход на миллион токенов. Это готовые альтернативы, пока GLM-5.3 не появилась в каталоге GPT Proto.
Можно ли получить доступ к GLM-5.3 через GPT Proto?
Нет. В настоящее время GLM-5.3 недоступна в GPT Proto.
Не отправляйте glm-5.3 на эндпоинт GPT Proto и не описывайте GPT Proto как провайдера GLM-5.3. Разработчики, которым сегодня нужен маршрут GLM, могут вызвать GLM-5.2. Следующий запрос использует существующий OpenAI-совместимый API GPT Proto и настоящий идентификатор модели glm-5.2:
curl "https://gptproto.com/v1/chat/completions" \
--header "Authorization: Bearer $GPTPROTO_API_KEY" \
--header "Content-Type: application/json" \
--data '{
"model": "glm-5.2",
"messages": [
{
"role": "user",
"content": "Review this implementation plan and identify the three highest-risk dependencies."
}
]
}'
Когда GLM-5.3 станет доступна, источником истины для строки модели GPT Proto, модальностей, контекста и цены должна быть её рабочая страница, а не публикация на основе слухов.
Вы также можете открыть галерею AI-моделей GPT Proto, чтобы сравнить доступные текстовые, рассуждающие, графические, видеомодели и мультимодальные маршруты с помощью одного API-ключа и единого баланса.
Стоит ли разработчикам переходить на GLM-5.3 уже сейчас?
Если вы уже подписаны на Z.ai Coding Plan, GLM-5.3 стоит протестировать сейчас. Благодаря автоматической маршрутизации вы уже можете получать её при запросе GLM-5.2 или GLM-5.1 через этот продукт. Фиксируйте фактически выбранную модель, уровень усилий, настройку контекста, расход токенов, задержку, повторные попытки и прохождение результата проверки.
Не воспринимайте обновление маршрутизации как доказательство улучшения каждой рабочей нагрузки. Более новая модель кодинга может лучше следовать инструкциям, расходуя при этом больше выходных кредитов. Она может справляться с более сложными задачами, отвечая медленнее на максимальном уровне усилий. Важен не вопрос «Увеличился ли номер версии?», а вопрос «Стала ли принятая работа дешевле или надёжнее?»
Отложите превращение GLM-5.3 в производственную зависимость, если вам необходимо что-либо из следующего:
Стабильная цена API с оплатой за токены
Публичные ограничения скорости и гарантии пропускной способности
Загружаемые веса и подтверждённая лицензия
Нативный ввод изображений через тот же маршрут модели
Независимые результаты по кодингу, работе агентов, задержке и пропускной способности
Проверенная страница модели и эндпоинт GPT Proto
Для проекта, который должен выйти в продакшен сегодня, используйте документированную модель и сделайте идентификатор модели настраиваемым. Это позволит позднее оценить GLM-5.3 без переписывания остального приложения.
Итоговый вердикт
GLM-5.3 существует и доступна для вызова, но её выпуск уже, чем предполагает название модели. Сейчас это новейшая модель в Z.ai GLM Coding Plan с задокументированной опцией контекста 1M, настройками усилий low/high/max и совместимостью с несколькими агентами кодинга.
Не менее важно и то, чего у нас нет: датированного объявления о запуске, карточки модели GLM-5.3, стандартной цены за токены, открытых весов и отчёта о бенчмарках. Поэтому GLM-5.3 — достойный кандидат для оценки, но пока не модель, которую можно честно сравнивать с Kimi K3, Fable 5 или даже GLM-5.2 по стоимости одной успешной задачи.
Если вы уже платите за Coding Plan, протестируйте её. Если вам нужен документированный API-маршрут уже сейчас, начните с GLM-5.2, Kimi K3 или Claude Fable 5 и сохраните возможность переключения модели.