GLM-5.2
- 上下文
- 1M
- 输入价
- $1.40 / 百万 tokens
- 输出价
- $4.40 / 百万 tokens
- 许可
- 开源
概览
智谱 2026 年 6 月 16 日发布的长上下文旗舰,753B 参数 MoE,引入 IndexShare——每四层稀疏注意力复用同一个索引器,在 100 万 token 上下文下把每 token 的浮点运算量降低约 2.9 倍,从而把百万级上下文做到稳定可用、显著减少长任务中的上下文漂移。擅长把整个代码库放进一条推理链里做项目级工程、长篇重构与论文复现。以 MIT 协议开放权重且无地域限制,可通过 Transformers、vLLM、SGLang、KTransformers 等框架部署。GLM-5.3 与它同底座,差异主要来自后训练。
- 模态
- 文本
- 参数量
- 753B (MoE)
- 许可说明
- 开源 · MIT
能力
- 100 万 token 无损上下文,最大输出 128K token
- 项目级代码承载与长程重构
- 函数调用、上下文缓存与结构化输出
- MCP 工具接入
- MIT 协议开放权重,无地域限制
基准测试
分数按各测试原始量表列示,不同测试之间不作百分比换算。
| 测试项目 | 得分 | 量表 |
|---|---|---|
| AIME 2026 | 99.2 | / 100 |
| MCP-Atlas | 76.8 | / 100 |
| SWE-Bench Pro | 62.1 | / 100 |
| HLE | 40.5 | / 100 |
版本历史
2026-06
上下文 1M输入 $1.40 / 百万 tokens输出 $4.40 / 百万 tokens- 首次发布,支持 100 万 token 无损上下文
- 引入 IndexShare 稀疏注意力,百万上下文算力降低约 2.9 倍
- 项目级代码承载与工程规范遵循能力增强



