就在刚刚,智谱 AI 把 GLM-5.2 的模型权重开放出来了,同时 API 服务也上线。其实在上周六,GLM-5.2 已经先面向 GLM Coding Plan 订阅用户开放使用。这次更新的重点,是权重开放和 API 正式接入。这代模型最值得关注的地方,有几个:第一,GLM-5.2...
这代模型最值得关注的地方,有几个:
第一,GLM-5.2 是 MoE 架构。 它的参数总量是 7530 亿,但单次推理时大约只激活 400 亿参数。简单理解,就是模型规模很大,但每次回答不会把全部参数都调动起来,这样可以在能力和计算成本之间做平衡。
第二,它提供了两档推理模式。 High 模式更偏向日常使用,兼顾速度和回答质量。Max 模式更适合复杂任务,比如自动编程、复杂调试、多步骤分析这类场景。
第三,它支持 100 万 token 长上下文。 这意味着它可以处理更长的文档、代码库、资料合集和多轮任务。对需要读长文件、做长链路分析的人来说,这个能力会更实用。
智谱还在底层架构里加入了 IndexShare,也就是索引共享技术。它让稀疏注意力层每 4 层共享同一套检索索引,从而降低长上下文场景下的单 token 计算开销。官方给出的数据是,在 100 万 token 长度下,计算开销降低约 2.9 倍。
这次 GLM-5.2 的权重采用 MIT 协议开放,意味着开发者可以基于它做更多二次开发和商业场景探索。API 价格则和上一代 GLM-5.1 保持一致。

