Todos os quatro modelos estão disponíveis no GPTProto com a mesma chave, então esta comparação é sobre adequação, não acesso. As pontuações abaixo são Elo do LMArena do snapshot de 25 de agosto de 2026.
|
Grok Imagine Image 2.0 |
Seedream 5.0 Pro |
Nano Banana 2 |
GPT Image 2 |
| String do modelo |
grok-imagine-image-2.0 |
dola-seedream-5-0-pro-260628 |
gemini-3.1-flash-image |
gpt-image-2 |
| Provedor |
SpaceXAI |
ByteDance |
Google |
OpenAI |
| Elo de texto para imagem da Arena |
1,316 |
1,258 |
1,263 |
1,382 |
| Elo de edição de imagem da Arena |
1,439 |
— |
— |
1,463 |
| Preço no GPTProto |
$0.04 / imagem |
$0.0405 (1K) · $0.081 (2K) |
$0.0402 / imagem |
$6.40 / $24.00 por 1M de tokens |
| Imagens de referência |
até 5 |
Entrada de texto + imagem |
Entrada de texto + imagem |
até 16 |
| Resolução máxima |
2K |
2K nativo |
1K |
2K nativo |
| Edição em nível de região |
Varinha mágica + segmentação |
— |
edições em linguagem natural |
baseado em máscara |
| Texto na imagem |
forte, legível em pontos pequenos |
14 idiomas |
multilíngue |
multilíngue, incl. CJK |
| Modelo de cobrança |
valor fixo por imagem |
valor fixo por imagem |
valor fixo por imagem |
medido por tokens |
Leia a tabela por tarefa, não por pontuação total.
Se o trabalho for edição — retocar uma foto de produto, trocar um fundo, manter um personagem ao longo de uma série — o Grok Imagine Image 2.0 é a escolha mais forte desta lista depois do GPT-Image-2, e a diferença de 24 pontos de Elo entre eles (1,439 vs 1,463) é menor que a diferença na previsibilidade do custo operacional. Com um valor fixo de $0.04 por imagem, um lote de edição de 1,000 imagens custa $40 independentemente da resolução ou do comprimento do prompt. O GPT Image 2 cobra por token, então o mesmo lote cai em uma faixa que você só conhece depois do fato — bom para trabalho exploratório, desconfortável para um trabalho de cliente com orçamento fechado.
Se o trabalho for texto para imagem do zero, o GPT Image 2 vence em preferência bruta (1,382 Elo) e não há como argumentar honestamente o contrário. O Grok Imagine Image 2.0 fica em 1,316, à frente do Seedream 5.0 Pro e do Nano Banana 2, mas atrás da OpenAI.
Se o entregável contiver texto denso na imagem em uma escrita não latina, a renderização de texto em 14 idiomas do Seedream 5.0 Pro é a ferramenta mais direta, e seu 2K nativo sai por $0.081 — o dobro do custo do 2K do Grok.
Se a taxa de transferência importa mais do que os últimos pontos de Elo, o Nano Banana 2 a $0.0402 tem efetivamente o mesmo preço do Grok Imagine Image 2.0 e gera mais rápido, mas é limitado a 1K e não oferece um equivalente de máscara regional à Varinha mágica.
Uma ressalva sobre os números: as pontuações da Arena do Grok Imagine Image 2.0 têm intervalos de confiança mais amplos (±12 em texto para imagem) do que os modelos estabelecidos, porque ele tem 2,675 votos contra 75,014 do GPT-Image-2. Trate-o como um forte sinal de primeira linha, e não como um ranking consolidado.
Migrando da API da SpaceXAI
Se você já chama a SpaceXAI diretamente, a migração é uma troca de base_url e uma troca de string de modelo — o corpo da requisição continua compatível com OpenAI. Três diferenças para planejar:
Nomenclatura do modelo. A própria API da SpaceXAI expõe esta geração por meio de seus nomes de modelo por nível de qualidade. No GPTProto, a string é grok-imagine-image-2.0, uma única string que cobre os níveis de qualidade baixo e médio via parâmetro quality, em vez de dois IDs de modelo separados.
Superfície de conta. O acesso direto exige uma conta SpaceXAI e seu próprio saldo pré-pago. No GPTProto, a mesma chave e o mesmo saldo também alcançam Seedream 5.0 Pro, Nano Banana 2, GPT Image 2 e mais de 200 outros modelos, então um teste A/B entre quatro modelos de imagem é uma mudança de uma linha na string do modelo, em vez de quatro cadastros, quatro relações de cobrança e quatro conjuntos de limites de taxa para conciliar.
Caminho de fallback. Como os modelos compartilham um único saldo, uma geração que falhou ou foi filtrada pode ser repetida com um modelo de imagem diferente no mesmo caminho de código. Mantenha uma string de modelo secundária na configuração — gemini-3.1-flash-image é a correspondência mais próxima em preço e modalidade, a $0.0402 por imagem.
Política de Conteúdo e Uso
O Grok Imagine Image 2.0 é posicionado pela SpaceXAI para trabalho comercial e profissional, um reposicionamento deliberado após o incidente de deepfake de janeiro de 2026 que levou a xAI a restringir a geração de imagens a níveis pagos. Duas consequências práticas para usuários de API.
Primeiro, o modelo vem com modelos pré-configurados voltados a categorias comerciais — fotos de produto, retratos profissionais, listagens de e-commerce, arte conceitual de jogos, pôsteres de marketing. Esses são presets da superfície do produto, e não parâmetros de API, mas sinalizam para o que o treinamento foi otimizado, e prompts escritos nesses registros têm resultado mais confiável.
Segundo, as requisições estão sujeitas à filtragem de conteúdo upstream da SpaceXAI, que o GPTProto repassa sem alterações. O GPTProto não adiciona uma segunda camada de moderação nem remove a do provedor. Uma requisição filtrada é uma decisão do provedor, não da plataforma. Se seu pipeline precisar de um fallback para gerações filtradas, direcione a nova tentativa para outro modelo de imagem usando a mesma chave, em vez de reformular o prompt no local.