$ cat wiki/models/glm-5-2.md
GLM-5.2
modelupdated 2026-07-28created 2026-07-13
Spec
| Attribute | Value |
|---|---|
| Developer | Z.ai (Z.ai / Zhipu AI) |
| Released | 2026-06-13 (구독자) / 2026-06-16 (공개 가중치 + API) |
| Announced | unknown |
| Context window | 1,000,000 토큰 |
| Pricing | $0.73/M input · $2.30/M output ($0.14/M 캐시 입력) — 리셀러 가격 (OpenRouter 카탈로그, 2026-07-28 판독). Z.ai 는 여전히 자체 정가를 공개하지 않는다. |
| License | MIT (제한 없음, "지역 제한 없음") |
| Availability | GLM Coding Plan (최상위 구독 계층), 독립 API, 공개 가중치, NVIDIA NIM 호스팅 |
| Total parameters | 744B |
| Active parameters | 토큰당 약 40B (Mixture-of-Experts) |
| Max output tokens | 131,072 |
| Reasoning modes | high, max 노력 등급 |
Release Date
- 2026년 6월 13일: Z.ai GLM Coding Plan 구독자에게 제공
- 2026년 6월 16일: 공개 가중치 배포 + 독립 API 출시
⚡ 참고: 27일 늦게 캡처됐다(2026년 7월 13일 인제스트). GLM-5.2 의 릴리스 시기가 Grok V9-Medium(6월 16일) 출시와 겹쳤고, 그 주의 Tier-1 소스 폴링에서 드러나지 않았다.
Architecture: IndexShare
GLM-5.2 는 IndexShare 를 도입했다 — 희소 어텐션에 대한 아키텍처 최적화로, 100만 토큰 컨텍스트 전 구간에서 표준 희소 어텐션 대비 토큰당 연산을 2.9배 줄인다. 100만 컨텍스트 역량이 이론이 아니라 실용적인 주된 이유다.
Benchmarks
| Benchmark | GLM-5.2 | Notes |
|---|---|---|
| Code Arena | 글로벌 2위 | 장기 코딩 평가 3종에서 Claude Opus 4.8 에 약 1pp 뒤진다 |
| 장기 코딩 (GPT-5.5 대비) | GPT-5.5 를 앞선다 | API 비용은 약 6분의 1 |
- Interconnects.ai 는 이를 "오픈 에이전트의 단계적 도약" 이라고 표현했다
- 데이터 위험 참고: TechTimes(6월 17일) — Z.ai 호스팅 API 는 질의를 Zhipu AI 의 중국 소재 인프라로 보낸다. 데이터가 민감한 워크로드라면 공개 가중치를 자체 호스팅하는 편이 권장된다.
Use Cases
- 장기 에이전틱 코딩 과제 (주 목표 — Code Arena 2위)
- 라이선스·데이터 경로 절충을 수용할 수 있는 조직에게 Opus 4.8 의 비용 효율적 대안
- 데이터 경로 위험 없이 프런티어급 공개 가중치가 필요한 조직의 자체 호스팅 배포
Compared To
| Model | Code Arena / SWE-Pro | License | Cost |
|---|---|---|---|
| GLM-5.2 | 2위 (장기 코딩) | MIT | GPT-5.5 API 비용의 약 6분의 1 |
| Claude Opus 4.8 | 1위 (장기) | 폐쇄형 | Mtok 당 $15/$75 |
| GPT-5.5 | GLM-5.2 미만 (코딩) | 폐쇄형 | OpenAI 표준 API |
| Mistral Large 3 | 미정 (2026년 7월 GA) | Apache 2.0 | 미정 |
| Llama 4 | GLM-5.2 미만 | Meta 자체 라이선스 | 무료 (자체 호스팅) |
Referenced by
Sources
- sources/blogs/zai-2026-06-16-glm-5-2.md
- https://venturebeat.com/technology/z-ais-open-weights-glm-5-2-beats-gpt-5-5-on-multiple-long-horizon-coding-benchmarks-for-1-6th-the-cost
- https://aiweekly.co/alerts/zais-glm-52-brings-1m-token-context-to-open-weight-coding
- https://www.techtimes.com/articles/318543/20260617/glm-52-open-weights-live-top-coding-benchmark-api-use-carries-china-data-risk.htm
- https://openrouter.ai/z-ai/glm-5.2