Контекст на 1 млн токенов
MiniMax M3 обрабатывает до 1 048 576 токенов с гарантированным минимумом в 512K. MSA сохраняет целостность поиска по всему окну, поэтому целые репозитории и длинные документы помещаются в один промпт.
curl --request POST "https://gptproto.com/v1/chat/completions" \
--header "Authorization: Bearer $GPTPROTO_API_KEY" \
--header "Content-Type: application/json" \
--data '{
"model": "MiniMax-M3",
"messages": [
{
"role": "user",
"content": "Hello"
}
]
}'Estimate a request with real work scenarios. GPTProto token pricing is 20% below official rates.
Cost calculator
Top up
GPTProto vs official pricing.Save$25.00 (20%)vs MiniMax official
Используйте API MiniMax M3 на GPTProto — модели с открытыми весами для программирования и агентских задач с контекстом на 1M токенов — по цене $0.96 за 1M выходных токенов, с одним ключом для более чем 200 моделей и без региональной регистрации.
MiniMax M3 обрабатывает до 1 048 576 токенов с гарантированным минимумом в 512K. MSA сохраняет целостность поиска по всему окну, поэтому целые репозитории и длинные документы помещаются в один промпт.
MiniMax M3 работает на базе MiniMax Sparse Attention (MSA), сокращая вычисления на токен при контексте в 1M примерно до 1/20 от поколения M2 — предварительное заполнение выполняется более чем в 9 раз быстрее, а декодирование — в 15 раз быстрее.
MiniMax M3 создан для продолжительной работы агентов и программирования — автономной декомпозиции задач, вызовов инструментов и многошагового рассуждения в рамках одной сессии на 1M токенов, оптимизированной на многошаговых рабочих процессах разработчиков.
В собственных тестах MiniMax модель M3 набирает 59.0% в SWE-Bench Pro и 83.5 в BrowseComp — превосходя GPT-5.5 и Gemini 3.1 Pro в программировании и Opus 4.7 в веб-поиске.
MiniMax M3 — это большая языковая модель с открытыми весами от MiniMax (MiniMaxAI), выпущенная 1 июня 2026 года. Она ориентирована на задачи программирования и работы агентов с длинным горизонтом: автономную декомпозицию задач, использование инструментов и многошаговое рассуждение в контексте объёмом 1 млн токенов. Её ключевое отличие — MiniMax Sparse Attention (MSA), которая выбирает важные блоки ключей и значений вместо обработки каждого токена — именно поэтому окно в 1 миллион токенов становится практически применимым, а не просто цифрой в спецификации. В GPTProto вы обращаетесь к API MiniMax M3 через единый баланс аккаунта, общий для более чем 200 других моделей, и отдельная регистрация в MiniMax не требуется.
| Параметр | MiniMax M3 |
|---|---|
| Разработчик | MiniMax (MiniMaxAI), Шанхай |
| Дата выпуска | 1 июня 2026 года |
| Тип | Большая языковая модель с открытыми весами |
| Архитектура | Mixture-of-Experts · 428B всего / 23B активных · 256 экспертов |
| Механизм внимания | MiniMax Sparse Attention (MSA) |
| Контекстное окно | 1 048 576 токенов (гарантированный минимум 512K) |
| Максимальный вывод | до ~512K токенов |
| Входная модальность | текст (на этой странице) · изображение / файл через подстраницу преобразования изображения в текст |
| Выходная модальность | текст |
| Режим рассуждения | переключается для каждого запроса |
| Использование инструментов / вызов функций | да |
| Конечная точка | https://gptproto.com/v1/chat/completions (совместима с OpenAI) |
| Цена GPTProto | $0.48 / 1M входных · $0.96 / 1M выходных |
| Строка модели GPTProto | MiniMax-M3 |
Обе модели работают в GPTProto с одним и тем же ключом и балансом. M2.5 — более ранняя текстовая модель с полным механизмом внимания; M3 переходит на разреженное внимание (MSA), поддерживает практическое окно в 1 млн токенов и добавляет ввод изображений через свою подстраницу преобразования изображения в текст.
| MiniMax M3 | MiniMax M2.5 | |
|---|---|---|
| Механизм внимания | MSA (разреженное) | Полное внимание |
| Ввод (на этой странице) | текст | текст |
| Ввод изображений | через подстраницу преобразования изображения в текст | — |
| Контекстное окно | 1 048 576 токенов |
204 800 токенов |
| Цена GPTProto (ввод / вывод за 1M) | $0.48 / $0.96 | $0.24 / $0.96 |
| Лучше всего подходит для | Программирования и работы агентов с длинным горизонтом, контекста 1M | Рассуждений по тексту при меньшей стоимости и более коротком контексте |
Если вы уже обращаетесь к MiniMax напрямую, переход на GPTProto не потребует значительных изменений: укажите в клиенте конечную точку GPTProto, передайте ключ GPTProto и задайте модель MiniMax-M3. Формат запроса и ответа соответствует формату чата OpenAI, поэтому существующие участки кода останутся без изменений. Вы сохраняете единый баланс для более чем 200 моделей, обходите отдельную регистрацию на платформе MiniMax и избегаете проблем с региональными платежами, с которыми западные разработчики сталкиваются на официальной шанхайской платформе.
Важный нюанс при миграции: GPTProto ожидает API-ключ непосредственно в заголовке Authorization — без префикса Bearer. Если ваш OpenAI SDK автоматически добавляет Bearer, задайте заголовок вручную.
bash
curl --location 'https://gptproto.com/v1/chat/completions' \
--header 'Authorization: GPTPROTO_API_KEY' \
--header 'Content-Type: application/json' \
--data '{
"model": "MiniMax-M3",
"messages": [{ "role": "user", "content": "Who are you?" }],
"stream": false
}'
Да. MiniMax выпустила M3 как модель с открытыми весами, опубликовав веса и технический отчёт на Hugging Face и GitHub. В GPTProto вы можете обращаться к размещённому API MiniMax M3 без самостоятельного развёртывания — это удобно, если вам нужны длинный контекст и поведение агента этой модели, но не требуется самостоятельно запускать модель с 229.9B параметров и обеспечивать её GPU-инфраструктурой.
Всё, что нужно знать об интеграции модели MiniMax M3 в рабочий процесс: от ограничений контекста до цен и безопасности данных.
Руководства, сравнения и обновления по этой модели.
Все статьи
Seedance 2.0 Mini — это не «вдвое дешевле»: в API модель примерно на 20% дешевле. Основная экономия достигается за счёт черновой генерации в разрешении 720p. Актуальные цены, рабочий код и рекомендации по выбору тарифа для запуска.

Руководство для разработчиков по Kling 3.0 Motion Control: сравнение pro и std, ограничения на входные данные, советы по составлению промптов и рабочий код API (Python + cURL) через GPTProto.

GLM 5.2 — модель Z.ai с открытыми весами, лицензией MIT и контекстом на 1 млн токенов. Узнайте о её функциях, результатах тестов в сравнении с Claude Opus 4.8 и GPT-5.5, ценах и способах запуска.

Сравнение MiniMax M3 и DeepSeek V4 Pro по цене, результатам тестов и мультимодальности. Какую китайскую модель с открытыми весами действительно выбрать — и в чём заключается ловушка SWE-bench, которую допускает большинство руководств.