Qwen 3.8 Max — новая китайская флагманская модель Alibaba с 2,4 трлн параметров, однако доступная сегодня версия всё ещё называется qwen3.8-max-preview. Этот суффикс имеет значение. По состоянию на 21 июля 2026 года Alibaba не выпустила ни продакшен-модель, ни технический отчёт, ни стандартную цену API за токены, ни загружаемые веса.
Превью стало доступно 19 июля через Alibaba Token Plan, Qoder и QoderWork. В официальном объявлении Qwen команда сообщила, что Qwen 3.8 скоро станет моделью с открытыми весами, и описала её как сопоставимую с ведущими передовыми моделями, уступающую только Fable 5. Публичный набор тестов или методология, подтверждающие этот рейтинг, не были представлены.
Мой краткий вывод: Qwen 3.8 Max — настоящее и необычно интересное превью, но не завершённый запуск продукта. Разработчикам стоит протестировать модель, фиксировать дату каждого результата и не планировать миграцию в продакшен на основе спецификаций, которые Alibaba пока не опубликовала.
Qwen 3.8 Max вкратце
| Вопрос |
Что подтверждено на 21 июля 2026 года |
| Официальный идентификатор модели |
qwen3.8-max-preview |
| Дата выпуска превью |
19 июля 2026 года |
| Разработчик |
Alibaba Qwen |
| Позиционирование модели |
Новый флагман Qwen; Alibaba называет её своей последней и самой мощной моделью Qwen |
| Количество параметров |
2,4 трлн параметров всего |
| Входные данные |
Понимание текста и изображений, согласно материалам Alibaba о запуске |
| Основные сценарии использования, названные Alibaba |
Полностековая разработка, анализ данных, офисные процессы, анализ визуальных документов и пользовательских интерфейсов |
| Доступ |
Alibaba Token Plan, Qoder и QoderWork |
| Обычная цена API за токены |
Не опубликована |
| Контекстное окно |
Не опубликовано |
| Активные параметры на токен |
Не опубликованы |
| Веса |
Пока недоступны; Alibaba заявляет, что выпуск модели с открытыми весами состоится |
| Дата выпуска продакшен-версии |
Не объявлена |
Этот список короче таблиц характеристик, появляющихся в некоторых ранних материалах о Qwen 3.8 Max. И на то есть причина. У модели в статусе превью не появляется контекстное окно на 1 млн токенов, конкретная архитектура Mixture-of-Experts или лицензия на выпуск только потому, что такие детали выглядели бы правдоподобно рядом с характеристиками других флагманов 2026 года.
Выпущена ли Qwen 3.8 Max?
Да — в формате превью. Нет — если речь идёт о завершённом продакшен-релизе.
Alibaba запустила qwen3.8-max-preview 19 июля 2026 года. В документации Qwen Cloud говорится, что модель будет постоянно улучшаться в течение периода превью, а позднее может быть удалена или заменена продакшен-версией. Это превращает эндпоинт в подвижную цель: тест, проведённый 21 июля, может не воспроизвести поведение модели неделю спустя.
Подтверждённой даты выпуска продакшен-версии Qwen 3.8 Max нет. Формулировка «скоро станет моделью с открытыми весами» также не является датой. Пока Alibaba не опубликует карточку модели, контрольную точку, лицензию и стабильный идентификатор модели, любые более точные сроки остаются спекуляцией.
Именно здесь текущие результаты поиска искажают картину. В нескольких заголовках дата выхода превью преподносится как дата полноценного релиза. Разработчикам нужны обе даты, поскольку превью, подходящее для интерактивной сессии кодирования, автоматически не становится подходящим для версионированного серверного приложения.
Что означает заявление о 2,4 трлн параметров?
Цифра 2,4 трлн является официальной. Её практическое значение пока неизвестно.
Общее количество параметров показывает масштаб контрольной точки. Но оно не говорит, сколько параметров активно для каждого токена, сколько памяти потребуется для самостоятельного развёртывания или насколько быстро будет работать модель. Эти вопросы зависят от архитектуры, квантования, кэширования, маршрутизации и стека обслуживания.
Kimi K3 показывает, почему это различие важно. Её описывают как модель Mixture-of-Experts с 2,8 трлн параметров, но для каждого токена активируются 16 из 896 экспертов. GLM-5.2 публикует данные примерно о 753 млрд параметров всего и около 40 млрд активных параметров на токен. Alibaba не раскрыла аналогичный показатель активных параметров для Qwen 3.8 Max.
Поэтому 2,4 трлн — это не показатель скорости. И не показатель стоимости. До выхода технического отчёта воспринимайте эту цифру как заголовок о размере модели.
Является ли Qwen 3.8 Max моделью с открытым исходным кодом?
Сегодня — нет. Alibaba заявляет, что Qwen 3.8 скоро станет моделью с открытыми весами.
Открытые веса и открытый исходный код — не одно и то же. Выпуск модели с открытыми весами предоставляет возможность скачать веса модели; лицензия определяет, что разработчики могут изменять, распространять или использовать в коммерческих целях. Alibaba пока не подтвердила, какая именно контрольная точка Qwen 3.8 будет выпущена, будет ли это точная модель Max на 2,4 трлн параметров и какая лицензия будет применяться.
Если самостоятельное развёртывание необходимо уже сейчас, GLM-5.2 — более очевидный выбор: её веса и лицензия MIT уже опубликованы. Qwen 3.8 Max может стать более мощным вариантом, но это сравнение будущего, а не текущий факт о доступном развёртывании.
Цены Qwen 3.8 Max: подписка, а не обычный тариф API
Alibaba не опубликовала стандартную цену за миллион входных и выходных токенов для Qwen 3.8 Max Preview. Сейчас доступ предоставляется через кредиты внутри Token Plan.
Стартовые цены индивидуальных планов:
| План |
Цена на старте |
Стандартная цена |
Кредитов на 5 часов |
Кредитов на 7 дней |
| Lite |
$6/месяц |
$8/месяц |
700 |
2 500 |
| Standard |
$18/месяц |
$25/месяц |
3 000 |
10 000 |
| Pro |
$68/месяц |
$80/месяц |
12 000 |
40 000 |
Это ограниченные по времени стартовые цены. В период превью Qwen Cloud сообщает, что Qwen 3.8 Max может расходовать всего 10% от обычного количества кредитов. Также заявлена дополнительная скидка на кредиты с 22:00 до 08:00 по UTC+8.
Ограничение важнее скидки. Кредиты — это не токены, и Alibaba не публикует простой коэффициент пересчёта, который позволил бы честно сравнить стоимость миллиона токенов. Расход кредитов может меняться в зависимости от выбора модели, рассуждений, кэширования и вызовов инструментов.
Индивидуальный Token Plan также запрещает использовать его ключ для автоматизированных скриптов, серверных частей приложений и неинтерактивных пакетных заданий. Он предназначен для интерактивного кодирования и агентских инструментов. Проще говоря: текущее предложение Qwen 3.8 Max полезно для оценки и разработки с ассистентом, но это не обычная инфраструктура с оплатой по фактическому использованию для клиентского продукта.
Что показывают первые тесты Qwen 3.8 Max?
Заявление Alibaba о том, что модель «уступает только Fable 5», является утверждением поставщика. Компания не опубликовала названия тестов, баллы, промпты, настройки агента или методику оценки, на которых основан этот вывод. Публичного технического отчёта Qwen 3.8 и подтверждённой независимой позиции в рейтингах также пока нет.
Один полезный ранний тест — это сопоставительное сравнение StackPerf с Kimi K3. Обе модели изучали замороженные копии 269 файлов и получили 60 минут на создание проекта интеграции уровня репозитория с цитатами, этапами миграции, тестами и журналом доказательств. Перед проверкой отчёты были обезличены.
Kimi K3 набрала 83/100 после учёта фактических ошибок; Qwen 3.8 Max Preview — 80/100. Qwen получила 9/10 за использование инструментов против 8/10 у Kimi, успешно выполнила все 44 вызова инструментов и создала более длинный отчёт с меньшим количеством запросов. Kimi завершила работу быстрее, использовала меньше токенов в проверенном сценарии и полнее обработала исправления и повторную генерацию.
Это убедительное свидетельство для одного типа работы по проектированию программной архитектуры с длинным контекстом. Но оно не доказывает, что Kimi K3 в целом лучше или что Qwen в целом лучше. Модели работали через разных поставщиков, а задержка маршрута, кэширование, нагрузка после запуска и настройки рассуждений повлияли на результат.
Ранняя картина в сообществе также неоднозначна. В основном обсуждении запуска на Hacker News один тестировщик сообщил, что задача с анимированным SVG потребовала более 10 минут рассуждений, тогда как другой разработчик отметил, что превью хорошо справляется с кодированием, но пока слишком новое для окончательной оценки. Это отдельные свидетельства, а не тесты. Однако они указывают на два показателя, которые стоит измерить самостоятельно: время до получения пригодного ответа и выполнение задачи на один токен.
Qwen 3.8 Max против Qwen 3.7 Max
Qwen 3.8 Max выглядит как расширение возможностей, но Qwen 3.7 Max сегодня остаётся более безопасным выбором для API.
| Параметр |
Qwen 3.8 Max Preview |
Qwen 3.7 Max |
| Статус |
Постоянно обновляемое превью |
Существующая API-модель |
| Опубликованные параметры |
2,4 трлн всего |
Не являются главным публичным преимуществом |
| Визуальное понимание |
Alibaba заявляет, что поддерживается |
Только текст |
| Контекст |
Не опубликован |
1 млн токенов |
| Максимальный вывод |
Не опубликован |
65 536 токенов |
| Веса |
Обещаны, но не выпущены |
Закрытые веса |
| Цены |
Кредиты Token Plan; обычный тариф за токены отсутствует |
Цена GPT Proto: $0.36 за вход / $1.44 за выход на 1 млн |
| Использование в продакшен-бэкенде |
Индивидуальный план запрещает автоматизированное использование в бэкенде |
Обычный API-доступ с оплатой по факту использования |
Я бы не выполнял слепое обновление строки модели с Qwen 3.7 Max до превью 3.8. Сначала проверьте стабильность ответов, схемы инструментов, задержку, расход токенов на рассуждения и то, сохраняет ли финальная продакшен-модель поведение превью.
Если вам нужен API Qwen для приложения уже сейчас, существующий эндпоинт Qwen 3.7 Max станет практичным промежуточным решением:
curl "https://gptproto.com/v1/chat/completions" \
-H "Authorization: Bearer $GPTPROTO_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "qwen3.7-max",
"messages": [
{
"role": "user",
"content": "Review this architecture and list the three highest-risk assumptions."
}
]
}'
Этот запрос обращается к Qwen 3.7 Max, а не к Qwen 3.8 Max. Такое различие позволяет избежать распространённой ошибки в первую неделю после запуска: публикации кода для эндпоинта, которого нет на платформе.
Qwen 3.8 Max против Kimi K3, GLM-5.2 и Fable 5
Честное сравнение асимметрично, поскольку для Qwen 3.8 Max не хватает нескольких публичных спецификаций.
| Модель |
Главная причина протестировать её сейчас |
Основной компромисс |
| Qwen 3.8 Max Preview |
Новый флагман Qwen с 2,4 трлн параметров, визуальным пониманием и сильными ранними результатами в агентских задачах |
Нестабильное превью, неизвестные контекст и цена токенов, отсутствие весов |
| Kimi K3 |
Опубликованная архитектура MoE на 2,8 трлн параметров, мультимодальный контекст на 1 млн токенов, обычный API-доступ |
Постоянное рассуждение может увеличивать задержку и стоимость вывода |
| GLM-5.2 |
Открытые веса под лицензией MIT, известное количество активных параметров, контекст на 1 млн токенов, более дешёвое агентское кодирование |
Только текст; по некоторым задачам общие возможности могут уступать самым новым закрытым превью |
| Fable 5 |
Ориентир, названный в собственном заявлении Qwen о работе на длинном горизонте |
Более высокая цена, при этом Qwen не опубликовала доказательства своего сравнительного утверждения |
В сравнении Qwen 3.8 Max и Kimi K3 лучшее доступное сопоставительное тестирование даёт Kimi преимущество в три балла, но Qwen получает более высокий результат по использованию инструментов. В сравнении Qwen 3.8 Max и GLM-5.2 решение зависит не столько от неподтверждённого рейтинга качества, сколько от развёртывания: у GLM уже есть загружаемые веса под лицензией MIT, а у Qwen — нет. В сравнении Qwen 3.8 Max и Fable 5 пока недостаточно публичных данных, чтобы подтвердить рейтинг Alibaba.
См. полное сравнение Qwen 3.8 Max и Kimi K3
Стоит ли разработчикам использовать Qwen 3.8 Max уже сейчас?
Используйте модель уже сейчас, если оцениваете агентов для кодирования, работу с мультимодальными документами или рассуждения на уровне репозитория и готовы мириться с тем, что превью меняется прямо во время тестов. Сохраняйте идентификатор модели, дату, промпты, определения инструментов и исходные ответы. Без этого последующее сравнение будет практически бессмысленным.
Пока не стройте на ней миграцию в продакшен, если вам нужны фиксированное поведение, тарификация бэкенда по фактическому использованию, опубликованный предел контекста или веса для самостоятельного развёртывания. Сейчас превью не даёт ответа ни на один из этих четырёх вопросов.
Для продакшен-задач сегодня направляйте типичные сценарии через модели со стабильным доступом и опубликованными ограничениями. GPT Proto позволяет сравнивать Qwen 3.7 Max, Kimi K3 и GLM-5.2 с одного баланса. Также можно просмотреть полную коллекцию моделей или перейти на главную страницу GPT Proto.
За Qwen 3.8 Max стоит следить. Отсутствующая карточка модели важнее очередного превосходного эпитета в день запуска.