本周科技圈热闹非凡,继Meta的Muse Glimmer、英伟达(NVIDIA)的Nemotron 3.5 Lightning、深度求索(DeepSeek)的V4 Pro以及谷歌(Google)的Gemini 3.7 Flash相继登场后,今天,来自中国AI实验室智谱(Zhipu)的GLM-5.3成为焦点。

智谱(Zhipu)的GLM-5.3主要聚焦于编程与安全领域,在相关基准测试中取得了显著进步,例如在DeepSWE上提升约1.5倍,在Terminal Bench 3.0上提升6倍,并在CyberGym上展现出顶尖实力。
GLM-5.3的独特之处在于,它继承了前代模型7430亿的参数规模,所有在编程和网络安全方面的提升,均源自智谱(Zhipu)独特的后训练协议。
正因如此,GLM-5.3在DeepSWE上得分66.9,而GLM 5.2为46.2,Anthropic的Mythos级Fable 5则为69.7。
在Terminal Bench 3.0上,GLM-5.3得分28.3,GLM-5.2为4.6,Fable 5为33.7。
在CyberGym上,GLM-5.3目前以84.5分的成绩领先,Fable 5为83.8分,GPT-5.6 Sol为83.6分。
请记住,所有这些进步都完全归功于智谱(Zhipu)的后训练流程,这本身就是一项非常令人瞩目的成就。
智谱(Zhipu)还发布了一份清单,披露了在269个开源项目中发现的2436项安全发现,其中1097项属于严重或高危级别。有趣的是,GLM-5.3发现的最古老漏洞可以追溯到1981年!更重要的是,这些安全漏洞平均藏匿了26.6年才被发现。
最后,请注意,智谱(Zhipu)的下一代模型将采用全新的架构,参数量将翻倍,这表明该AI实验室现在正认真瞄准Fable 5的市场地位。该公司将在几天内发布GLM-5.3的模型权重。



