MiniMax M3 é um modelo de linguagem de grande porte de pesos abertos da MiniMax (MiniMaxAI), lançado em 1 de junho de 2026. Ele é voltado para cargas de trabalho de codificação de longo horizonte e de agentes: decomposição autônoma de tarefas, uso de ferramentas e raciocínio em múltiplas etapas em um contexto de 1M de tokens. Sua mudança definidora é a MiniMax Sparse Attention (MSA), que seleciona os blocos de chave–valor que importam em vez de prestar atenção a todos os tokens — o motivo pelo qual uma janela de 1 milhão de tokens é viável de executar, em vez de ser apenas um número de ficha técnica. No GPTProto, você chama a API do MiniMax M3 por meio de um único saldo de conta compartilhado com 200+ outros modelos, sem exigir cadastro separado na MiniMax.
Tabela de especificações:
| Campo |
MiniMax M3 |
| Desenvolvedor |
MiniMax (MiniMaxAI), Xangai |
| Lançamento |
1 de junho de 2026 |
| Tipo |
LLM de pesos abertos |
| Arquitetura |
Mixture-of-Experts · 428B total / 23B ativos · 256 especialistas |
| Atenção |
MiniMax Sparse Attention (MSA) |
| Janela de contexto |
1,048,576 tokens (mínimo garantido de 512K) |
| Saída máxima |
até ~512K tokens |
| Modalidade de entrada |
texto (nesta página) · imagem / arquivo via a subpágina image-to-text |
| Modalidade de saída |
texto |
| Modo de raciocínio |
alternável por requisição |
| Uso de ferramentas / chamada de função |
sim |
| Endpoint |
https://gptproto.com/v1/chat/completions (compatível com OpenAI) |
| Preço no GPTProto |
$0.48 / 1M de entrada · $0.96 / 1M de saída |
| String do modelo no GPTProto |
MiniMax-M3 |
MiniMax M3 vs MiniMax M2.5
Ambos os modelos rodam no GPTProto com a mesma chave e saldo. O M2.5 é o modelo de texto anterior, com atenção total; o M3 adota atenção esparsa (MSA) e uma janela prática de 1M de tokens, além de adicionar entrada de imagem por meio da sua subpágina image-to-text.
| |
MiniMax M3 |
MiniMax M2.5 |
| Atenção |
MSA (esparsa) |
Atenção total |
| Entrada (nesta página) |
texto |
texto |
| Entrada de imagem |
via subpágina image-to-text |
— |
| Janela de contexto |
1,048,576 tokens |
204,800 tokens
|
| Preço no GPTProto (entrada / saída por 1M) |
$0.48 / $0.96 |
$0.24 / $0.96 |
| Melhor para |
Codificação de longo horizonte & execuções de agentes, contexto de 1M |
Raciocínio de texto de menor custo em contexto mais curto |
Migrando da API oficial da MiniMax
Se você já chama a MiniMax diretamente, migrar para o GPTProto é uma troca direta: aponte seu cliente para o endpoint do GPTProto, passe sua chave do GPTProto e defina o modelo como MiniMax-M3. O formato das requisições e respostas segue o formato de chat da OpenAI, então os caminhos de código existentes permanecem os mesmos. Você mantém um único saldo em 200+ modelos, dispensa um cadastro separado na plataforma MiniMax e evita o atrito de pagamento regional que desenvolvedores ocidentais enfrentam na plataforma oficial de Xangai.
Um ponto de atenção na migração: o GPTProto espera a chave de API diretamente no cabeçalho Authorization — sem o prefixo Bearer. Se o seu SDK da OpenAI adiciona Bearer automaticamente, defina o cabeçalho manualmente.
bash
curl --location 'https://gptproto.com/v1/chat/completions' \
--header 'Authorization: GPTPROTO_API_KEY' \
--header 'Content-Type: application/json' \
--data '{
"model": "MiniMax-M3",
"messages": [{ "role": "user", "content": "Who are you?" }],
"stream": false
}'
O MiniMax M3 é de código aberto?
Sim. A MiniMax lançou o M3 como um modelo de pesos abertos, com pesos e um relatório técnico publicados no Hugging Face e no GitHub. No GPTProto, você pode chamar a API hospedada do MiniMax M3 sem self-hosting — útil quando você quer o comportamento de contexto longo e de agente do modelo, mas não o custo de GPU de executar 229.9B parâmetros por conta própria.