MiniMax M3 — это большая языковая модель с открытыми весами от MiniMax (MiniMaxAI), выпущенная 1 июня 2026 года. Она ориентирована на задачи программирования и работы агентов с длинным горизонтом: автономную декомпозицию задач, использование инструментов и многошаговое рассуждение в контексте объёмом 1 млн токенов. Её ключевое отличие — MiniMax Sparse Attention (MSA), которая выбирает важные блоки ключей и значений вместо обработки каждого токена — именно поэтому окно в 1 миллион токенов становится практически применимым, а не просто цифрой в спецификации. В GPTProto вы обращаетесь к API MiniMax M3 через единый баланс аккаунта, общий для более чем 200 других моделей, и отдельная регистрация в MiniMax не требуется.
Таблица характеристик:
| Параметр | MiniMax M3 |
|---|---|
| Разработчик | MiniMax (MiniMaxAI), Шанхай |
| Дата выпуска | 1 июня 2026 года |
| Тип | Большая языковая модель с открытыми весами |
| Архитектура | Mixture-of-Experts · 428B всего / 23B активных · 256 экспертов |
| Механизм внимания | MiniMax Sparse Attention (MSA) |
| Контекстное окно | 1 048 576 токенов (гарантированный минимум 512K) |
| Максимальный вывод | до ~512K токенов |
| Входная модальность | текст (на этой странице) · изображение / файл через подстраницу преобразования изображения в текст |
| Выходная модальность | текст |
| Режим рассуждения | переключается для каждого запроса |
| Использование инструментов / вызов функций | да |
| Конечная точка | https://gptproto.com/v1/chat/completions (совместима с OpenAI) |
| Цена GPTProto | $0.48 / 1M входных · $0.96 / 1M выходных |
| Строка модели GPTProto | MiniMax-M3 |
MiniMax M3 и MiniMax M2.5: сравнение
Обе модели работают в GPTProto с одним и тем же ключом и балансом. M2.5 — более ранняя текстовая модель с полным механизмом внимания; M3 переходит на разреженное внимание (MSA), поддерживает практическое окно в 1 млн токенов и добавляет ввод изображений через свою подстраницу преобразования изображения в текст.
| MiniMax M3 | MiniMax M2.5 | |
|---|---|---|
| Механизм внимания | MSA (разреженное) | Полное внимание |
| Ввод (на этой странице) | текст | текст |
| Ввод изображений | через подстраницу преобразования изображения в текст | — |
| Контекстное окно | 1 048 576 токенов |
204 800 токенов |
| Цена GPTProto (ввод / вывод за 1M) | $0.48 / $0.96 | $0.24 / $0.96 |
| Лучше всего подходит для | Программирования и работы агентов с длинным горизонтом, контекста 1M | Рассуждений по тексту при меньшей стоимости и более коротком контексте |
Переход с официального API MiniMax
Если вы уже обращаетесь к MiniMax напрямую, переход на GPTProto не потребует значительных изменений: укажите в клиенте конечную точку GPTProto, передайте ключ GPTProto и задайте модель MiniMax-M3. Формат запроса и ответа соответствует формату чата OpenAI, поэтому существующие участки кода останутся без изменений. Вы сохраняете единый баланс для более чем 200 моделей, обходите отдельную регистрацию на платформе MiniMax и избегаете проблем с региональными платежами, с которыми западные разработчики сталкиваются на официальной шанхайской платформе.
Важный нюанс при миграции: GPTProto ожидает API-ключ непосредственно в заголовке Authorization — без префикса Bearer. Если ваш OpenAI SDK автоматически добавляет Bearer, задайте заголовок вручную.
bash
curl --location 'https://gptproto.com/v1/chat/completions' \
--header 'Authorization: GPTPROTO_API_KEY' \
--header 'Content-Type: application/json' \
--data '{
"model": "MiniMax-M3",
"messages": [{ "role": "user", "content": "Who are you?" }],
"stream": false
}'
Является ли MiniMax M3 моделью с открытым исходным кодом?
Да. MiniMax выпустила M3 как модель с открытыми весами, опубликовав веса и технический отчёт на Hugging Face и GitHub. В GPTProto вы можете обращаться к размещённому API MiniMax M3 без самостоятельного развёртывания — это удобно, если вам нужны длинный контекст и поведение агента этой модели, но не требуется самостоятельно запускать модель с 229.9B параметров и обеспечивать её GPU-инфраструктурой.













