MiniMax M3 es un modelo de lenguaje grande de pesos abiertos de MiniMax (MiniMaxAI), lanzado el 1 de junio de 2026. Está orientado a la programación de largo recorrido y a cargas de trabajo de agentes: descomposición autónoma de tareas, uso de herramientas y razonamiento en varios pasos con un contexto de 1 millón de tokens. Su cambio principal es MiniMax Sparse Attention (MSA), que selecciona los bloques de clave y valor relevantes en lugar de prestar atención a cada token — por eso una ventana de 1 millón de tokens resulta práctica de ejecutar y no es solo una cifra de especificaciones. En GPTProto puedes llamar a la API de MiniMax M3 mediante un único saldo de cuenta compartido con más de 200 modelos, sin necesidad de registrarte por separado en MiniMax.
Tabla de especificaciones:
| Campo | MiniMax M3 |
|---|---|
| Desarrollador | MiniMax (MiniMaxAI), Shanghái |
| Lanzamiento | 1 de junio de 2026 |
| Tipo | LLM de pesos abiertos |
| Arquitectura | Mezcla de expertos · 428B totales / 23B activos · 256 expertos |
| Atención | MiniMax Sparse Attention (MSA) |
| Ventana de contexto | 1.048.576 tokens (mínimo garantizado de 512K) |
| Salida máxima | hasta ~512K tokens |
| Modalidad de entrada | texto (en esta página) · imagen / archivo mediante la subpágina de imagen a texto |
| Modalidad de salida | texto |
| Modo de razonamiento | activable según la solicitud |
| Uso de herramientas / llamadas a funciones | sí |
| Endpoint | https://gptproto.com/v1/chat/completions (compatible con OpenAI) |
| Precio de GPTProto | $0.48 / 1M de entrada · $0.96 / 1M de salida |
| Cadena del modelo de GPTProto | MiniMax-M3 |
MiniMax M3 frente a MiniMax M2.5
Ambos modelos funcionan en GPTProto con la misma clave y el mismo saldo. M2.5 es el modelo de texto anterior, con atención completa; M3 cambia a la atención dispersa (MSA) y a una ventana práctica de 1 millón de tokens, y añade entrada de imágenes mediante su subpágina de imagen a texto.
| MiniMax M3 | MiniMax M2.5 | |
|---|---|---|
| Atención | MSA (dispersa) | Atención completa |
| Entrada (esta página) | texto | texto |
| Entrada de imágenes | mediante la subpágina de imagen a texto | — |
| Ventana de contexto | 1.048.576 tokens |
204.800 tokens |
| Precio de GPTProto (entrada / salida por 1M) | $0.48 / $0.96 | $0.24 / $0.96 |
| Ideal para | Programación de largo recorrido y ejecuciones de agentes, contexto de 1M | Razonamiento de texto de menor coste con un contexto más corto |
Cambiar desde la API oficial de MiniMax
Si ya llamas directamente a MiniMax, pasar a GPTProto es un cambio directo: apunta tu cliente al endpoint de GPTProto, proporciona tu clave de GPTProto y establece el modelo como MiniMax-M3. La estructura de la solicitud y la respuesta sigue el formato de chat de OpenAI, por lo que las rutas de código existentes permanecen iguales. Mantienes un único saldo para más de 200 modelos, evitas registrarte por separado en la plataforma de MiniMax y evitas las dificultades de pago regionales que encuentran los desarrolladores occidentales en la plataforma oficial de Shanghái.
Un detalle importante de la migración: GPTProto espera la clave de API directamente en el encabezado Authorization — sin el prefijo Bearer. Si tu SDK de OpenAI añade automáticamente Bearer, establece el encabezado manualmente.
bash
curl --location 'https://gptproto.com/v1/chat/completions' \
--header 'Authorization: GPTPROTO_API_KEY' \
--header 'Content-Type: application/json' \
--data '{
"model": "MiniMax-M3",
"messages": [{ "role": "user", "content": "Who are you?" }],
"stream": false
}'
¿MiniMax M3 es de código abierto?
Sí. MiniMax lanzó M3 como un modelo de pesos abiertos, con los pesos y un informe técnico publicados en Hugging Face y GitHub. En GPTProto puedes llamar a la API alojada de MiniMax M3 sin encargarte del alojamiento propio — resulta útil cuando quieres las capacidades de contexto largo y de agente del modelo, pero no el consumo de GPU de ejecutar tú mismo 229.9B parámetros.













