GLM-5.2:面向长时程任务,落地百万 Token 上下文与开源推理栈
智谱 AI 发布旗舰模型 GLM-5.2,重点提升长时程任务能力,首次在 1M token 上下文窗口上稳定运行,并采用 MIT 开源许可。架构层面引入 IndexShare 技术,每 4 层 Transformer 共享稀疏注意力索引器,使 1M 上下文下每 token FLOPs 降低 2.9 倍;改进 MTP 层,通过 IndexShare 与 KV 共享消除训练-推理差异,配合拒绝采样与端到端 TV 损失,将推测解码接受长度提升 20%。后训练阶段,基于 slime 框架统一组织大规模 agentic RL 训练,并引入反作弊模块,在线检测并阻断 agent 读取受保护评估产物、curl 下载答案等投机行为,维持训练信号有效性。GLM-5.2 在 FrontierSWE、PostTrainBench、SWE-Marathon 等长时程基准上位居开源模型第一,在 Terminal-Bench 2.1 上得分 81.0,逼近闭源前沿。文章适合关注长上下文推理、编码智能体、开源大模型工程化的开发者阅读。