O GLM-5.2 é o principal lançamento de junho de 2026 da série GLM-5 da Z.ai (anteriormente Zhipu AI) — um modelo Mixture-of-Experts de pesos abertos criado especificamente para agentes de codificação de longo horizonte, e não para chat geral. Ele combina um contexto utilizável de 1M de tokens com chamada nativa de ferramentas, suporte a MCP e saída JSON estruturada, e é distribuído sob uma licença de código aberto MIT que você pode auto-hospedar. No GPTProto, a API GLM-5.2 é um acesso pré-pago por uso medido, sem barreiras regionais de cadastro e com um único saldo compartilhado entre mais de 200 modelos.
| Especificações |
GLM-5.2 |
| Desenvolvedor |
Z.ai (anteriormente Zhipu AI) |
| Arquitetura |
Mixture-of-Experts, ~753B total / ~40B ativos por token |
| Janela de contexto |
1.000.000 de tokens (sem perda) |
| Saída máxima |
131.072 tokens (~128K) |
| Modalidade |
Entrada de texto, saída de texto |
| Raciocínio |
Esforço selecionável — Alto / Máximo |
| Uso de ferramentas |
Chamada nativa de funções, MCP, JSON estruturado |
| Licença |
MIT (pesos abertos) |
| Lançamento |
13 de junho de 2026 |
| Preço no GPTProto |
$1.26 entrada / $3.96 saída por 1M de tokens (10% abaixo do preço de tabela da Z.ai) |
| String do modelo da API |
glm-5.2 (slug do provedor z-ai, contexto completo de 1M) |
GLM-5.2 vs GLM-5 e GLM-5.1
Todos os três lançamentos GLM-5 estão disponíveis no GPTProto, então subir de versão é apenas trocar a string do modelo — mesma chave, mesmo saldo. O salto para o 5.2 é principalmente sobre tamanho do contexto e estabilidade em tarefas longas:
| |
GLM-5 |
GLM-5.1 |
GLM-5.2 |
| Lançamento |
Fev 2026 |
Abr 2026 |
Jun 2026 |
| Janela de contexto |
Classe ~200K |
Classe ~200K |
1.000.000 (≈5x) |
| SWE-bench Pro* |
— |
58.4 |
62.1 |
| Atenção de contexto longo |
padrão |
padrão |
IndexShare (−2.9x de computação) |
| Decodificação especulativa |
— |
— |
MTP (+~20% de tokens aceitos) |
| Saída do GPTProto / 1M |
$2.88 |
$3.96 |
$3.96 |
A conclusão prática: o GLM-5.2 tem o mesmo preço de saída de $3.96 do GLM-5.1 no GPTProto, mas oferece cerca de 5x mais contexto e um aumento mensurável em codificação de longo horizonte — então, para trabalho em escala de repositório, não há muito motivo para continuar no 5.1.
GLM-5.2 vs GPT-5.5
O GPT-5.5 também está no GPTProto, então esta é uma troca real, não uma comparação de marketing. Nos benchmarks de codificação de longo horizonte divulgados pela Z.ai, o GLM-5.2 supera o GPT-5.5 na maioria das tarefas de agente, custando muito menos por token:
| Benchmark (divulgado pelo fornecedor, Z.ai) |
GLM-5.2 |
GPT-5.5 |
| SWE-bench Pro |
62.1 |
58.6 |
| FrontierSWE (longo horizonte) |
74.4% |
72.6% |
| MCP-Atlas (uso de ferramentas) |
77.0 |
75.3 |
| Humanity's Last Exam (com ferramentas) |
54.7 |
52.2 |
| Terminal-Bench 2.1 |
81.0 |
84.0 |
| Preço GPTProto / 1M (entrada / saída) |
$1.26 / $3.96 |
$4 / $24 |
No GPTProto, a API GLM-5.2 custa cerca de 3x menos na entrada e 6x menos na saída do que o GPT-5.5 ($1.26/$3.96 vs $4/$24 por 1M). O GPT-5.5 ainda lidera em tarefas de terminal puras, então não é uma vitória completa — mas para codificação baseada em agentes, orientada a ferramentas e em várias etapas, a vantagem nos benchmarks favorece o GLM-5.2 por uma fração do custo. No índice independente Artificial Analysis Intelligence Index v4.1, o GLM-5.2 pontua 51, competitivo na fronteira aberta, embora não supere todos os modelos fechados em tarefas gerais.
Migrando da API oficial da Z.ai
Se você já utiliza o GLM-5.2 na API da Z.ai, migrar para o GPTProto é uma substituição direta: mantenha o corpo da requisição e altere a URL base e a chave. Você obtém o mesmo modelo glm-5.2 sem conta separada na Z.ai, sem atrito regional de cadastro e com um saldo único que também cobre GPT-5.5, Claude, Gemini e mais de 200 outros modelos. O endpoint exato e a string do modelo estão no Início Rápido abaixo.