智谱发布GLM-5.3 编程能力提升50% 权重两周内开源

2026年8月14日,智谱正式发布GLM-5.3。据IT之家报道,这一版本与GLM-5.2使用相同基座,智谱将变化归因于后训练阶段的Scaling,并确认完整模型权重将在两周内开放。

编程能力被放在最前面

智谱称,GLM-5.3是其目前编程能力最强的开源模型。在内部自建体感评测中,GLM-5.3较GLM-5.2提升50%;在Terminal-Bench 3.0和Agents' Last Exam (CLI)等公开基准中,智谱称其拿到开源第一。

具体数字方面,智谱给出的Terminal-Bench 3.0得分从4.6提高到28.3,DeepSWE v1.1从46.2提高到66.9。分数跨度集中在代码智能体和终端类任务上,说明这次更新更偏向"能不能把任务做完",而不只是生成一段代码。

后训练是这次发布的关键

与常见的"新基座、新参数"叙事不同,GLM-5.3没有更换底座。智谱表示,提升来自后训练阶段的强化学习,训练过程引入了更多长程任务环境和更长的后训练时间。

这类路线的好处是目标明确:把已有基座在复杂任务中的执行能力继续压榨出来。对开发者而言,模型在终端操作、多步骤修复、代码审查等场景里的可用性,可能比通用聊天能力的变化更容易被感知。

安全与开源安排

智谱还提到,GLM-5.3在白盒代码审查、漏洞发现等网络安全任务中的表现持平Mythos 5。官方将其定位为面向网络安全防御场景的潜在能力,这类能力仍要看后续实际场景验证。

开源节奏上,GLM-5.3的完整模型权重将在两周内放出。智谱称,开放前会完成安全评估与模型加固。GLM Coding Plan全员额度已于8月14日13:00重置,开发者可以先通过官方Coding Plan试用,本地部署则需要等待权重开放。

这次更新的核心不是换基座,而是后训练能把同一个基座推到什么位置。权重开放后,社区能否复现官方给出的编程成绩,将是下一个观察点。

发布评论
全部评论(0)