avatar

GLM-5.2 开源权重:闭源模型的高溢价时代正在终结

Z.ai 发布 1M 上下文的 GLM-5.2 开源权重,开发者开始迁移,闭源模型的利润空间收窄。

avatar@Zai_org
2 months ago

TL;DR:

  • Coding Plan 用户现在就能用,下周推出 API 和 MIT 许可——开源从让步变成了进攻手段。
  • 更强的基准成绩配合更低价格,闭源实验室越来越难为高端定价找理由。
  • 1M 上下文加上针对代理编码的优化,长链路工作流开始转向开放技术栈。
  • 开发者采用和微调生态的迭代速度可能比闭源版本更快,迁移会持续下去。
  • Z.ai 连续开源说明闭源定价权正在系统性走弱,不是一时的噪音。

Z.ai 选了一个微妙的时机发布 GLM-5.2:闭源前沿实验室已经很难说清楚高价到底贵在哪。可用的长上下文、稳健的代理编码能力、完全开源的权重,再加上更低的单位成本——定价的天平正在向开放一侧倾斜。

核心判断:

  • 开源权重 + 长上下文 + 即刻可用的分发,正在把开发和部署的默认选择推向开放模型。
  • 闭源溢价会被持续压缩,除非同步在上下文、速率限制和价格上做出同等力度的让步。
  • 生态速度成为决定性变量:开放权重激活的微调和工具链迭代,往往比闭源版本跑得更快。

中国实验室正把"可得性"变成护城河

Z.ai 从 GLM-5(744B-MoE、40B 激活,MIT 许可,2026 年 2 月)到 GLM-5.1(长链路代理能力)再到 GLM-5.2,能力和分发强度同步提升。GLM-5.2 直接向全部 Coding Plan 开放,并承诺下周提供 API 和 MIT 开源提交,把"开放获取"当作竞争优势而不是被动让步。相比之下,西方实验室仍然用速率限制和高 token 成本把前沿能力分成不同档次。

这利用了一个真实的不对称:GLM-5 在 SWE-Bench Verified 拿到 77.8%,在 Terminal-Bench 2.0 和 Vending Bench 2 领跑开源模型,同时价格大约是 Claude Opus 4.6 的 1/3 到 1/5。在这个基础上再加 1M 上下文和完全开放的权重,企业把代理工具链和工作流标准化到"够用且最便宜"选项上的概率大幅上升

不只是一次例行更新:被忽视的分发效应

  • 认为"开源只对研究有用"的看法已经过时了。真正的加速点在于:更快接入编码代理、DePIN 推理平台和低成本企业栈。
  • 对"中方实验室可靠性落后"的质疑,和 GLM-5 在幻觉检测与长链路一致性上的公开对比不符——后者相较既有开源模型有明显优势。
  • 闭源 API 的价格压力会进一步加剧。Z.ai 已经证明在国产芯片约束下仍能维持前沿性能,同时还把权重送出去。

| 叙事 | 证据 | 对行业认知的改变 | 我的判断 | |---|---|---|---| | 开源发布只是公关 | GLM-5 系列采用 MIT 许可,GLM-5.2 立即向 Coding Plan 全量开放 | 开发者默认选择可自托管、可微调、低锁定的模型 | 开源前沿模型正在靠生态占领取胜;闭源将在高频但价格敏感的场景丢份额 | | 上下文窗口成为新战场 | 1M 支持与代理编码能力同时发布 | 长文档与多步工作流从 128K–200K 的闭源 API 迁出 | 1M 上下文 + 开源权重在代理链路上形成复利优势,闭源若不开放难以跟上 | | 中方实验室难以维持同等水准 | GLM-5 仅用 Ascend 芯片训练,SWE-Bench 与代理基准有竞争力 | 迫使市场重估对海外硬件依赖的前提 | 国产算力链路的可行性得到验证,境外管制外的平行前沿集群概率上升 |

这些变化指向同一个方向:把"开源"和"真能力边际"绑定,直接改写商业分发曲线,而不只是做学术友好。

Significance: 中等
Categories: 模型发布, 开源

结论:构建者和开发者现在介入最有利,可以立刻获得更低成本和更高可控性的选型弹性;中长期投资者应该把 Z.ai 的连续开源视为闭源定价权结构性走弱的信号,而不是短期扰动。交易层面短期博弈空间有限,但对押注开放生态和算力替代链条的基金边际收益更大。