就在刚刚,智谱 AI 把 GLM-5.2 的模型权重开放出来了,同时 API 服务也上线。其实在上周六,GLM-5.2 已经先面向 GLM Coding Plan 订阅用户开放使用。这次更新的重点,是权重开放和 API 正式接入。这代模型最值得关注的地方,有几个:第一,GLM-5.2...

这代模型最值得关注的地方,有几个:

第一,GLM-5.2 是 MoE 架构。 它的参数总量是 7530 亿,但单次推理时大约只激活 400 亿参数。简单理解,就是模型规模很大,但每次回答不会把全部参数都调动起来,这样可以在能力和计算成本之间做平衡。

第二,它提供了两档推理模式。 High 模式更偏向日常使用,兼顾速度和回答质量。Max 模式更适合复杂任务,比如自动编程、复杂调试、多步骤分析这类场景。

第三,它支持 100 万 token 长上下文。 这意味着它可以处理更长的文档、代码库、资料合集和多轮任务。对需要读长文件、做长链路分析的人来说,这个能力会更实用。

智谱还在底层架构里加入了 IndexShare,也就是索引共享技术。它让稀疏注意力层每 4 层共享同一套检索索引,从而降低长上下文场景下的单 token 计算开销。官方给出的数据是,在 100 万 token 长度下,计算开销降低约 2.9 倍。

这次 GLM-5.2 的权重采用 MIT 协议开放,意味着开发者可以基于它做更多二次开发和商业场景探索。API 价格则和上一代 GLM-5.1 保持一致。

另外,GLM-5.2 也已经接入 OpenRouter,对海外开发者来说,调用路径会更方便一些。

整体看下来,这次更新不是单纯堆参数,而是把重点放在长上下文、代码任务、推理模式和部署可用性上。

如果你平时会用大模型处理代码、长文档、资料整理,GLM-5.2 值得关注一下。

当然,10点一到,我还是没抢到Coding Plan。。。羡慕你们#人工智能# #小红书热点观察团# #小红书科技观察团# #大模型# #人工智能就业# #小红书科技AMA# #howto培养AI球搭子# #coding#

发布于:北京市