作者: · 发布:

原创 逛逛 2026-08-15 16:54 吉林

GLM-5.3 来了,编程能力提升 50%,两周发现 2404 个漏洞。

智谱又发模型了,GLM-5.3。

它沿用 GLM-5.2 的同一基座,参数也没有增加,仅靠继续加码后训练,就在官方自建 Coding 榜单上实现了 50% 的提升,堪称后训练之王。

Coding 仍是主线,但这个新模型最抢眼的能力是网络安全。

发布前两周,智谱联合国内安全团队对 GLM-5.3 进行测试。

在国内外各大项目上一共发现了 2404 个潜在漏洞,其中 1088 个为中高危漏洞。

漏洞披露账簿截图

最早的风险可以追溯到 40 多年前,涉及 DNS、邮件与办公系统、通信软件、操作系统等每天都在使用的东西。

这个方向就很有意思了。

现在,最新一代的 GLM 模型开始读懂复杂系统,在海量代码里找风险、排查异常路径,还能参与后续的验证和修复。

GLM-5.3 持续推动 Coding 能力迈向生产级,并在此基础上自然延伸出一套安全能力。

01

GLM-5.3 模型简介

GLM-5.3 来了,编程能力提升 50%,两周发现 2404 个漏洞。

GLM-5.3 是智谱最新一代基座模型。这一代可以用三个关键词概括:Coding、网络安全、开源。

GLM-5.3 已经来到开源模型 Coding 能力的第一梯队。在评测 Z.ai Code Bench上比 GLM-5.2 提升50%

它沿用了 GLM-5.2 同一套基座,没有扩大参数规模,也没有重新做预训练,所有新增能力都来自后训练。

它证明了:大模型的能力上限,并不完全在基座预训练结束时就被确定,成熟的后训练同样可以持续榨出基座中尚未释放的智能。

GLM-5.3 来了,编程能力提升 50%,两周发现 2404 个漏洞。

在白盒代码审查、漏洞定位和安全推理等任务里,它又进入了一个更专业的场景。

我觉得这比单纯刷新一张榜单更值得看。

而且网络安全又把难度往上抬了一层。模型得读懂系统、提出假设、调用工具验证,再根据结果修正路线。

这套能力,和一个靠谱工程师处理真实项目时的工作方式越来越像了。

02

实测一下效果

复刻一个 Windows 98 的操作系统,应用和游戏都能点击玩耍。

做一个第一人称的 FPS 射击游戏

使用 Three.js 做一个第三人称群岛探索的宣传 Demo 演示。

做一个 3D 的沙盘小火车公园,可以自动切换成小火车第一视角。

03

两周发现了 2404 个漏洞

网络安全可以看作 Coding 能力变得越来越强后能做好的场景。

普通 Coding 任务关注功能有没有实现。

安全任务还需要顺着复杂逻辑寻找那些平时很难触发、出问题时后果又很严重的异常路径。

整个过程包含很多环节,对工具使用和长程规划的要求挺高的。

从目前公布的信息看,GLM-5.3 在白盒代码审查、漏洞定位和基础安全推理上,它已经达到全球前沿模型的水平。

到了复杂漏洞利用和完整攻防闭环,和最强闭源模型之间仍然存在差距。

安全能力很强,距离模型自己完成所有事情还有很远。

不过,发布前两周的测试结果已经足够夸张。

智谱联合国内安全团队发现了 2404 个潜在漏洞,其中 1088 个为中高危,覆盖 220 个项目。

GLM-5.3 来了,编程能力提升 50%,两周发现 2404 个漏洞。

比如安全研究团队借助 GLM,在 1983 年形成的 DNS 协议中发现了一类潜伏 40 多年的协议级风险。

少量特殊请求就可能把服务器的计算压力最高放大近 8 万倍,潜在影响超过 1000 万处公网 DNS 服务。

还有借助 GLM 3.5 发现了三枚微软重大漏洞,包括邮件预览、文档处理和服务端远程访问。

相关漏洞已经完成修复了,微软也公开致谢了 Kunlun Lab 与 GLM。

GLM-5.3 来了,编程能力提升 50%,两周发现 2404 个漏洞。

04

普通人怎么用上 GLM-5.3

目前最省事的入口是 ZCode。

GLM-5.3 来了,编程能力提升 50%,两周发现 2404 个漏洞。

GLM-5.3 会面向 GLM Coding Plan 用户开放,API 和完整模型权重也将按发布计划陆续提供。

第三方 Coding 平台会逐步接入。

体验入口:https://zcode.z.ai/cn
编程套餐:https://docs.bigmodel.cn/cn/coding-plan/overview

GLM 系列从 Coding 出发,已经开始进入网络安全这种更专业、更高价值的场景。

当攻击者已经开始使用 AI,防御者也需要一套能够自己掌握、随时调用的模型能力。

这可能才是 GLM-5.3 最有价值的地方。

颜资源站长
颜资源站长 已发布 825 篇文章

资深互联网从业者,专注AI工具研究与实战应用。长期跟踪ChatGPT、Claude、Stable Diffusion等前沿AI技术,擅长将复杂的技术概念转化为通俗易懂的教程。运营颜资源小站,致力于为中文用户提供高质量的AI教程、开源项目推荐和数字资源整理。