Les quatre modèles sont disponibles sur GPTProto avec la même clé, donc cette comparaison porte sur l'adéquation, pas sur l'accès. Les scores ci-dessous sont des Elo LMArena de l'instantané du 25 août 2026.
|
Grok Imagine Image 2.0 |
Seedream 5.0 Pro |
Nano Banana 2 |
GPT Image 2 |
| Chaîne de modèle |
grok-imagine-image-2.0 |
dola-seedream-5-0-pro-260628 |
gemini-3.1-flash-image |
gpt-image-2 |
| Fournisseur |
SpaceXAI |
ByteDance |
Google |
OpenAI |
| Elo Arena texte-vers-image |
1,316 |
1,258 |
1,263 |
1,382 |
| Elo Arena édition d'image |
1,439 |
— |
— |
1,463 |
| Prix GPTProto |
$0.04 / image |
$0.0405 (1K) · $0.081 (2K) |
$0.0402 / image |
$6.40 / $24.00 par 1M tokens |
| Images de référence |
jusqu'à 5 |
Entrée texte + image |
Entrée texte + image |
jusqu'à 16 |
| Résolution max |
2K |
2K natif |
1K |
2K natif |
| Édition au niveau régional |
Baguette magique + segmentation |
— |
retouches en langage naturel |
basé sur masque |
| Texte dans l'image |
net, lisible en petits corps |
14 langues |
multilingue |
multilingue, y compris CJK |
| Modèle de facturation |
forfait par image |
forfait par image |
forfait par image |
facturation au token |
Lisez le tableau par tâche, pas par score total.
Si le travail est de l'édition — retoucher une photo de produit, changer un arrière-plan, conserver un personnage d'une série à l'autre — Grok Imagine Image 2.0 est le meilleur choix de cette liste après GPT-Image-2, et l'écart Elo de 24 points entre eux (1,439 vs 1,463) est plus étroit que l'écart de prévisibilité des coûts d'exploitation. À 0,04 $ forfaitaire par image, un lot de 1 000 images à éditer coûte 40 $ quelle que soit la résolution ou la longueur du prompt. GPT Image 2 facture au token, donc le même lot tombe dans une fourchette que vous ne connaissez qu'après coup — parfait pour l'exploration, peu pratique pour un devis client.
Si le travail est du texte-vers-image à partir de zéro, GPT Image 2 gagne sur la préférence brute (1,382 Elo) et il n'y a pas de manière honnête de dire le contraire. Grok Imagine Image 2.0 se situe à 1,316, devant Seedream 5.0 Pro et Nano Banana 2, mais derrière OpenAI.
Si le livrable contient du texte dense dans l'image avec une écriture non latine, le rendu de texte en 14 langues de Seedream 5.0 Pro est l'outil le plus direct, et son 2K natif revient à 0,081 $ — le double du coût 2K de Grok.
Si le débit compte plus que les derniers points Elo, Nano Banana 2 à 0,0402 $ est effectivement au même prix que Grok Imagine Image 2.0 et génère plus vite, mais plafonne à 1K et n'offre pas d'équivalent de masque régional à la Baguette magique.
Une réserve sur les chiffres : les scores Arena de Grok Imagine Image 2.0 ont des intervalles de confiance plus larges (±12 en texte-vers-image) que les modèles établis, car il a 2 675 votes contre 75 014 pour GPT-Image-2. Considérez-le comme un signal fort de premier rang plutôt qu'un classement définitif.
Passer de l'API SpaceXAI
Si vous appelez déjà SpaceXAI directement, la migration se résume à un échange de base_url et de chaîne de modèle — le corps de la requête reste compatible OpenAI. Trois différences à anticiper :
Nommage des modèles. L'API propre à SpaceXAI expose cette génération via ses noms de modèles par niveau de qualité. Sur GPTProto, la chaîne est grok-imagine-image-2.0, une seule chaîne couvrant à la fois les niveaux de qualité low et medium via le paramètre quality plutôt que deux ID de modèle distincts.
Surface de compte. L'accès direct nécessite un compte SpaceXAI et son propre solde prépayé. Sur GPTProto, la même clé et le même solde donnent aussi accès à Seedream 5.0 Pro, Nano Banana 2, GPT Image 2 et plus de 200 autres modèles, donc un test A/B sur quatre modèles d'image est un changement d'une ligne de chaîne de modèle au lieu de quatre inscriptions, quatre relations de facturation et quatre ensembles de limites de débit à concilier.
Chemin de secours. Comme les modèles partagent un même solde, une génération échouée ou filtrée peut être retentée avec un autre modèle d'image dans le même chemin de code. Gardez une chaîne de modèle secondaire en config — gemini-3.1-flash-image est la correspondance la plus proche en prix et en modalité à 0,0402 $ par image.
Politique de contenu et utilisation
Grok Imagine Image 2.0 est positionné par SpaceXAI pour le travail commercial et professionnel, un repositionnement délibéré après l'incident de deepfake de janvier 2026 qui a conduit xAI à restreindre la génération d'images aux offres payantes. Deux conséquences pratiques pour les utilisateurs d'API.
Premièrement, le modèle est livré avec des modèles préconfigurés destinés à des catégories commerciales — photos de produits, portraits professionnels, fiches e-commerce, concept art de jeu, affiches marketing. Ce sont des préréglages de surface produit plutôt que des paramètres d'API, mais ils indiquent ce vers quoi l'entraînement a été optimisé, et les prompts écrits dans ces registres aboutissent plus fiablement.
Deuxièmement, les requêtes sont soumises au filtrage de contenu en amont de SpaceXAI, que GPTProto transmet sans modification. GPTProto n'ajoute pas de seconde couche de modération et ne supprime pas celle du fournisseur. Une requête filtrée est une décision du fournisseur, pas de la plateforme. Si votre pipeline a besoin d'un repli pour les générations filtrées, routez la nouvelle tentative vers un autre modèle d'image sur la même clé plutôt que de retravailler le prompt sur place.