GLM-5.2

厂家 / 系列
智谱GLM
上下文
1M
输入价
$1.40 / 百万 tokens
输出价
$4.40 / 百万 tokens
许可
开源

快速对比

GLM-5.2 固定为第一列,选择一个候选即可并列查看关键规格。

查看 GLM 系列对比

COMPARE MATRIX · 横向比较

模型比较

并列查看 0模型的关键规格

当前不足 2 项,可关闭面板后继续选择。

已选模型规格比较矩阵
比较项
规格暂无可比较规格
提示:左右滚动可查看全部项目

概览

智谱 2026 年 6 月 16 日发布的长上下文旗舰,753B 参数 MoE,引入 IndexShare——每四层稀疏注意力复用同一个索引器,在 100 万 token 上下文下把每 token 的浮点运算量降低约 2.9 倍,从而把百万级上下文做到稳定可用、显著减少长任务中的上下文漂移。擅长把整个代码库放进一条推理链里做项目级工程、长篇重构与论文复现。以 MIT 协议开放权重且无地域限制,可通过 Transformers、vLLM、SGLang、KTransformers 等框架部署。GLM-5.3 与它同底座,差异主要来自后训练。

模态
文本
参数量
753B (MoE)
许可说明
开源 · MIT

能力

  • 100 万 token 无损上下文,最大输出 128K token
  • 项目级代码承载与长程重构
  • 函数调用、上下文缓存与结构化输出
  • MCP 工具接入
  • MIT 协议开放权重,无地域限制

基准测试

分数按各测试原始量表列示,不同测试之间不作百分比换算。

测试项目得分量表
AIME 202699.2/ 100
MCP-Atlas76.8/ 100
SWE-Bench Pro62.1/ 100
HLE40.5/ 100

版本历史

  1. 2026-06

    上下文 1M输入 $1.40 / 百万 tokens输出 $4.40 / 百万 tokens
    • 首次发布,支持 100 万 token 无损上下文
    • 引入 IndexShare 稀疏注意力,百万上下文算力降低约 2.9 倍
    • 项目级代码承载与工程规范遵循能力增强

使用该模型的工具

浏览全部工具