MiniMax M3 est un grand modèle de langage à poids ouverts de MiniMax (MiniMaxAI), publié le 1er juin 2026. Il cible les charges de travail de codage et d’agents à long horizon : décomposition autonome des tâches, utilisation d’outils et raisonnement multi-étapes sur un contexte d’un million de tokens. Son changement décisif est l’attention sparse MiniMax (MSA), qui sélectionne les blocs clé–valeur importants au lieu de prêter attention à chaque token — c’est ce qui rend une fenêtre d’un million de tokens réellement exploitable, et non un simple chiffre sur une fiche technique. Sur GPTProto, vous appelez l’API MiniMax M3 via un solde de compte partagé avec plus de 200 autres modèles, sans inscription séparée à MiniMax.
Tableau des spécifications :
| Champ |
MiniMax M3 |
| Développeur |
MiniMax (MiniMaxAI), Shanghai |
| Date de sortie |
1er juin 2026 |
| Type |
LLM à poids ouverts |
| Architecture |
Mixture-of-Experts · 428B au total / 23B actifs · 256 experts |
| Attention |
MiniMax Sparse Attention (MSA) |
| Fenêtre de contexte |
1,048,576 tokens (minimum garanti de 512K) |
| Sortie maximale |
jusqu’à ~512K tokens |
| Modalité d’entrée |
texte (sur cette page) · image / fichier via la sous-page image-to-text |
| Modalité de sortie |
texte |
| Mode réflexion |
commutable par requête |
| Utilisation d’outils / appels de fonction |
oui |
| Endpoint |
https://gptproto.com/v1/chat/completions (compatible OpenAI) |
| Prix GPTProto |
$0.48 / 1M d’entrée · $0.96 / 1M de sortie |
| Identifiant du modèle GPTProto |
MiniMax-M3 |
MiniMax M3 vs MiniMax M2.5
Les deux modèles fonctionnent sur GPTProto avec la même clé et le même solde. M2.5 est le modèle texte précédent, à attention complète ; M3 passe à l’attention sparse (MSA) et à une fenêtre pratique d’un million de tokens, et ajoute l’entrée d’images via sa sous-page image-to-text.
| |
MiniMax M3 |
MiniMax M2.5 |
| Attention |
MSA (sparse) |
Attention complète |
| Entrée (cette page) |
texte |
texte |
| Entrée d’images |
via la sous-page image-to-text |
— |
| Fenêtre de contexte |
1,048,576 tokens |
204,800 tokens
|
| Prix GPTProto (entrée / sortie par 1M) |
$0.48 / $0.96 |
$0.24 / $0.96 |
| Idéal pour |
Codage à long horizon & exécutions d’agents, contexte 1M |
Raisonnement textuel à moindre coût sur contexte plus court |
Migrer depuis l’API officielle MiniMax
Si vous appelez déjà MiniMax directement, passer à GPTProto est un changement sans rupture : pointez votre client vers l’endpoint GPTProto, fournissez votre clé GPTProto et définissez le modèle sur MiniMax-M3. La forme des requêtes et des réponses suit le format de chat OpenAI, donc les chemins de code existants restent inchangés. Vous conservez un seul solde pour plus de 200 modèles, évitez une inscription séparée sur la plateforme MiniMax et contournez les frictions de paiement régionales que rencontrent les développeurs occidentaux sur la plateforme officielle de Shanghai.
Un piège de migration : GPTProto attend la clé API directement dans l’en-tête Authorization — pas de préfixe Bearer. Si votre SDK OpenAI ajoute automatiquement Bearer, définissez l’en-tête manuellement.
bash
curl --location 'https://gptproto.com/v1/chat/completions' \
--header 'Authorization: GPTPROTO_API_KEY' \
--header 'Content-Type: application/json' \
--data '{
"model": "MiniMax-M3",
"messages": [{ "role": "user", "content": "Who are you?" }],
"stream": false
}'
MiniMax M3 est-il open source ?
Oui. MiniMax a publié M3 en tant que modèle à poids ouverts, avec les poids et un rapport technique publiés sur Hugging Face et GitHub. Sur GPTProto, vous pouvez appeler l’API hébergée MiniMax M3 sans auto-hébergement — utile lorsque vous voulez le comportement du modèle en contexte long et pour les agents, mais pas l’empreinte GPU nécessaire pour exécuter vous-même 229.9B paramètres.