1M 토큰 무손실 컨텍스트
GLM-5.2는 전체 1,000,000토큰 창에서 높은 검색 정확도를 유지합니다. 이는 이전 GLM-5 한도의 약 5배로, 전체 모노레포나 긴 스펙을 한 번의 GLM-5.2 API 호출에 담을 수 있습니다.
curl --request POST "https://gptproto.com/v1/chat/completions" \
--header "Authorization: Bearer $GPTPROTO_API_KEY" \
--header "Content-Type: application/json" \
--data '{
"model": "glm-5.2",
"messages": [
{
"role": "user",
"content": "Hello"
}
]
}'Chat, coding agents & document work. Priced per 1M tokens — input, cached input and output are billed separately. GPTProto is 10% below official rates.
Z-AI · ≈ 148M tokens/mo (48M cached)
OpenRouter costs include its ~5.5% credit purchase fee. GPTProto applies a per-model discount (10–30% off) and your bonus credits are also spent at discounted rates — savings compound. Estimates assume a 60% cache hit rate.
GLM-5.2 API를 차별화하는 요소 — 1M 토큰 무손실 컨텍스트, IndexShare 희소 어텐션, MIT 오픈 가중치, 선택 가능한 High/Max 추론 강도.
GLM-5.2는 전체 1,000,000토큰 창에서 높은 검색 정확도를 유지합니다. 이는 이전 GLM-5 한도의 약 5배로, 전체 모노레포나 긴 스펙을 한 번의 GLM-5.2 API 호출에 담을 수 있습니다.
GLM-5.2는 장기적인 코딩 작업에 대해 수개월간 강화 학습을 거쳤으며, 수백 회의 반복에 걸쳐 이전 GLM-5 릴리스의 조기 정체 없이 자율적이고 다단계 엔지니어링 작업을 지속합니다.
4개 레이어마다 하나의 인덱서를 재사용하는 희소 어텐션 설계로, 전체 1M 컨텍스트에서 토큰당 어텐션 연산량을 최대 2.9배 절감하며, 멀티 토큰 예측과 함께 더 빠른 GLM-5.2 API 추론을 제공합니다.
GLM-5.2의 가중치는 OSI 승인 MIT 라이선스로 오픈소스 제공됩니다. 자체 호스팅, 파인튜닝, 상업적 사용이 자유롭고 사용자당 요금이 없으며, 이러한 성능 등급에서는 드문 경우입니다.
GLM-5.2는 Z.ai(구 Zhipu AI)의 GLM-5 시리즈에서 2026년 6월 플래그십 모델로, 일반 채팅보다는 장기 실행 코딩 에이전트를 위해 특별히 설계된 오픈 가중치 Mixture-of-Experts 모델입니다. 사용 가능한 1M 토큰 컨텍스트와 네이티브 도구 호출, MCP 지원, 구조화된 JSON 출력을 결합하며, 직접 호스팅할 수 있는 MIT 오픈소스 라이선스로 배포됩니다. GPTProto에서 GLM-5.2 API는 지역별 가입 제한 없이 사용량에 따라 요금이 부과되는 종량제 액세스로 제공되며, 하나의 잔액을 200개 이상의 모델에서 공유할 수 있습니다.
| 스펙 | GLM-5.2 |
|---|---|
| 개발사 | Z.ai (구 Zhipu AI) |
| 아키텍처 | Mixture-of-Experts, 총 ~753B / 토큰당 활성 ~40B |
| 컨텍스트 창 | 1,000,000 토큰 (무손실) |
| 최대 출력 | 131,072 토큰 (~128K) |
| 모달리티 | 텍스트 입력, 텍스트 출력 |
| 추론 | 추론 강도 선택 가능 — High / Max |
| 도구 사용 | 네이티브 함수 호출, MCP, 구조화된 JSON |
| 라이선스 | MIT (오픈 가중치) |
| 출시일 | 2026년 6월 13일 |
| GPTProto 가격 | 1M 토큰당 입력 $1.26 / 출력 $3.96 (Z.ai 공시 가격보다 10% 저렴) |
| API 모델 문자열 | glm-5.2 (프로바이더 슬러그 z-ai, 전체 1M 컨텍스트) |
세 가지 GLM-5 릴리스 모두 GPTProto에서 제공되므로 버전을 올리는 것은 모델 문자열만 바꾸면 되는 일입니다 — 동일한 키, 동일한 잔액을 사용합니다. 5.2로의 도약은 주로 컨텍스트 크기와 장기 작업 안정성에 관한 것입니다:
| GLM-5 | GLM-5.1 | GLM-5.2 | |
|---|---|---|---|
| 출시일 | 2026년 2월 | 2026년 4월 | 2026년 6월 |
| 컨텍스트 창 | ~200K급 | ~200K급 | 1,000,000 (≈5배) |
| SWE-bench Pro* | — | 58.4 | 62.1 |
| 장기 컨텍스트 어텐션 | 표준 | 표준 | IndexShare (연산량 −2.9배) |
| 추측적 디코딩 | — | — | MTP (수용 토큰 +~20%) |
| GPTProto 출력 / 1M | $2.88 | $3.96 | $3.96 |
실질적인 결론: GLM-5.2는 GPTProto에서 GLM-5.1과 동일한 출력 요금 $3.96을 유지하면서도 약 5배의 컨텍스트와 장기 실행 코딩에서 눈에 띄는 성능 향상을 제공합니다 — 따라서 리포지토리 규모 작업에서는 5.1에 머물 이유가 거의 없습니다.
GPT-5.5도 GPTProto에서 제공되므로 이는 마케팅 비교가 아닌 실제 교체입니다. Z.ai가 발표한 장기 실행 코딩 벤치마크에서 GLM-5.2는 대부분의 에이전트 작업에서 GPT-5.5를 근소하게 앞서면서 토큰당 비용은 훨씬 낮습니다:
| 벤치마크 (제조사 제공, Z.ai) | GLM-5.2 | GPT-5.5 |
|---|---|---|
| SWE-bench Pro | 62.1 | 58.6 |
| FrontierSWE (장기 실행) | 74.4% | 72.6% |
| MCP-Atlas (도구 사용) | 77.0 | 75.3 |
| Humanity's Last Exam (도구 사용 포함) | 54.7 | 52.2 |
| Terminal-Bench 2.1 | 81.0 | 84.0 |
| GPTProto 가격 / 1M (입력 / 출력) | $1.26 / $3.96 | $4 / $24 |
GPTProto에서 GLM-5.2 API는 GPT-5.5보다 입력에서 약 3배, 출력에서 약 6배 저렴합니다 (1M당 $1.26/$3.96 vs $4/$24). GPT-5.5는 여전히 순수 터미널 작업에서 앞서므로 완전한 압승은 아닙니다 — 그러나 에이전트형, 도구 기반, 다단계 코딩에서는 벤치마크 우위가 훨씬 적은 비용으로 GLM-5.2를 지지합니다. 독립적인 Artificial Analysis Intelligence Index v4.1에서 GLM-5.2는 51점을 기록해 오픈 프런티어에서 경쟁력을 갖추지만, 일반 작업에서는 모든 비공개 모델보다 앞서지는 않습니다.
이미 Z.ai API에서 GLM-5.2를 호출하고 있다면 GPTProto로의 전환은 드롭인 방식입니다. 요청 본문은 그대로 두고 base URL과 키만 변경하면 됩니다. 별도의 Z.ai 계정이나 지역별 가입 불편 없이 동일한 glm-5.2 모델을 사용할 수 있으며, 하나의 잔액으로 GPT-5.5, Claude, Gemini 및 200개 이상의 다른 모델도 이용할 수 있습니다. 정확한 엔드포인트와 모델 문자열은 아래 Quick Start에서 확인할 수 있습니다.
Zhipu AI의 오픈 웨이트 프레임워크를 통해 glm 5.2 성능, 컨텍스트 제한, 로컬 배포에 대한 답변을 확인하세요.
이 모델과 관련된 가이드, 비교, 업데이트입니다.
모든 글
GLM 5.2는 Z.ai의 오픈 웨이트, MIT 라이선스 코딩 모델로 100만 토큰 컨텍스트를 지원합니다. 기능, Claude Opus 4.8 및 GPT-5.5 대비 벤치마크, 가격, 실행 방법을 확인하세요.

2026년 최고의 텍스트-이미지 API 7개를 Arena Elo와 실제 가격 기준으로 선정했습니다 — GPT Image 2, Nano Banana, Seedream 5.0. 하나의 API 키로 모두 호출하세요.

Nano Banana 2는 Nano Banana Pro의 절반 가격이면서 Image Arena에서 더 높은 점수를 기록합니다. 각 Gemini 이미지 모델이 언제 승리하는지, 두 모델을 모두 실행할 수 있는 단일 API 코드도 확인하세요.

인쇄 가능한(300 DPI) 캐릭터 일관성 있는 AI 그림책 — 모든 페이지에 같은 캐릭터, KDP 준비 완료 파일 — 을 약 1달러의 API 비용으로 만드세요. 전체 코드 포함.