智谱GLM-5.3上线:编程能力提升50%,国产开源模型追平国际第一梯队

来源:互联网 时间:2026-08-20

8月19日,智谱正式上线GLM-5.3 API。这次更新最实在的地方在于:性能冲到了国际第一梯队,价格一分没涨。

先看成绩。在Artificial Analysis综合智能指数(AA指数)中,GLM-5.3拿到60分,与Claude Fable 5、GPT-5.6 Sol这些海外闭源旗舰并列同一水平线。在开源模型里,它与Kimi K3并列第一。这个分数放在两年前,没人敢想国产开源模型能摸到——当时头部开源模型与闭源旗舰的差距,用圈内的话说叫肉眼可见。

技术路线值得说道说道。GLM-5.3没有重新做预训练,而是在GLM-5.2基座(743B参数的MoE架构,每次激活约400亿参数)上,纯靠后训练和长程强化学习,把编程能力硬拉了50%。这条路子验证了一件事:预训练堆参数的红利见顶之后,后训练还能挖出大空间。对整个行业来说,这是个重要的方向性信号。

编程是这次的主打场景。官方口径是当前编程能力最强的开源模型,在TerminalBench 3.0、Agents' Last Exam这些公开基准测试里拿了开源第一,编程体感超过其他国产模型。做AI编程工具的开发者,可以直接上手验证。

更让人意外的是网络安全能力。在CyberGym测试中,模型从白盒源代码出发,通过触发程序故障来识别和验证漏洞,GLM-5.3得分84.5%。横向对比:GLM-5.2是77.2%,Mythos 5是83.8%,GPT-5.6 Sol是83.6%。国产开源模型在安全任务上追平甚至反超海外闭源模型,这是头一回。要知道,安全场景对模型的要求比写代码苛刻得多——不仅要读懂代码,还要还原系统逻辑、定位漏洞、判断影响面。

定价策略延续了智谱的打法:API价格与GLM-5.2持平。模型权重定于8月28日开源,也就是说,再过一周,任何人都可以下载这套权重自己部署。

配套动作还有一步棋。智谱同步启动了名叫开源的盾的计划:对重点开源项目做持续安全审计,帮维护者免费发现和修复风险,还向开源社区免费提供模型额度和更便捷的防御入口,开源项目维护者可以申请将其用于安全审计任务。网络安全正在变成AI竞争的高地,智谱显然想在这块立住身位。

把视野放大一点看,国产开源模型最近集体上强度:DeepSeek刚把线上模型升级到V3.1,上下文扩展到128K;此前发布的V4 Pro多项指标逼近国外顶尖闭源模型;阿里Qwen3.8-Max也进了LMArena综合榜前五。两边连续多周包揽全球开源模型调用量前两位。对开发者来说,眼下选国产开源模型,已经不是退而求其次,而是性价比和性能的双优解。

相关文章

A5创业网 版权所有

返回顶部