AI消息速览

智谱发布最强开源编程模型GLM-5.3,涌现安全能力

事件日期 2026-08-17 · 产业观察 · 已接受

事件日期2026-08-17
信息日期2026-08-17
入库日期2026-08-17
通道产业观察
状态已接受
来源腾讯研究院(搜狐同步)

知识卡片:智谱发布最强开源编程模型GLM-5.3,涌现安全能力

  • 英文标题(按中文标题直译,非官方):Zhipu AI Releases Strongest Open-Source Coding Model GLM-5.3, with Emergent Security Capabilities
  • 英文关键词:GLM-5.3; open-source coding model; post-training scaling; cybersecurity; Open Source Shield

一句话结论

据腾讯研究院AI速递(20260817)报道,智谱发布 GLM-5.3,称其在不改变基座的情况下依靠“极致后训练 Scaling”提升能力,成为编程能力最强的开源模型,并在网络安全任务中表现出与 Mythos 5 持平的白盒审查能力;模型预计“两周后开源”,同时启动“开源的盾”开源项目免费安全审计计划。

事件概述或研究问题

本条聚焦智谱 GLM-5.3 发布事件。报道称,该模型保持基座不变,主要靠后训练扩展提升编程能力;模型同时涌现出网络安全能力,并配套启动面向重点开源项目的安全审计计划“开源的盾”。

方法/产品要点

  • 基座不变,以后训练 Scaling 为主要提升路径。
  • 编程能力:Terminal-Bench 从 4.6 升至 28.3;DeepSWE 升至 66.9(DeepSWE 的对比基线未在材料中说明,待核实)。
  • 开源节奏:报道称“两周后开源”,但具体日期与开源许可证待核实。
  • 网络安全能力:在 CyberGym 白盒审查中得 84.5%,与 Mythos 5 持平。
  • 漏洞发现:累计发现漏洞 2,436 个,其中 1,097 个中高危;覆盖内核、浏览器、DNS 等 269 个项目。
  • 同步启动“开源的盾”计划,对重点开源项目提供免费安全审计,主张“前沿安全能力应开源共享而非闭源特权”。

主要结果或产业意义

  • 若报道属实,GLM-5.3 将成为编程能力最强的开源模型之一,直接切入开发者工具与智能体任务赛道。
  • 在网络安全评测中与闭源模型 Mythos 5 持平,挑战了“前沿安全能力只能闭源”的叙事。
  • 2,436 个漏洞、1,097 个中高危漏洞,显示模型可能在真实开源项目安全审计中具备规模化应用潜力。
  • “开源的盾”计划可能推动开源供应链安全从人工审计走向模型辅助审计。

为什么重要

本条提供了智谱 GLM 系列的新增量信息:它把开源模型的竞争焦点从通用对话、推理能力,拓展到“编程 + 网络安全”两个高价值方向。与已有相关卡片(NIST AI RMF、Epoch AI、OpenRouter)不同,本条不是基础设施或治理框架类条目,而是具体模型发布事件;其增量在于“基座不变、仅靠后训练 Scaling”和“安全能力开源共享”的主张。

局限与不确定性

  • 信息来自“腾讯研究院AI速递”摘要,并非智谱官方模型卡或论文;原始评测设置、代码是否开源、许可证均需进一步核实。
  • “编程能力最强开源模型”和“涌现安全能力”是报道中的说法,需待开源后由社区复现验证。
  • CyberGym 白盒审查的具体口径、与 Mythos 5 的比较方式,材料未展开。
  • 2,436 个漏洞是否全部由 GLM-5.3 自动发现、统计时间范围和判定标准,材料未说明,待核实。
  • “两周后开源”的具体含义与时间节点待核实。
  • DeepSWE 升至 66.9 的对比基线未给出,待核实。

可用于图书/PPT/简报的角度

  • 开源模型的后训练 Scaling 能否挑战闭源模型?
  • 编程与网络安全如何成为大模型能力竞争的新高地?
  • “安全能力开源共享”与“闭源特权”的路线之争。
  • 模型辅助开源安全审计:开源供应链风险的新解法?

原始材料

  • 标题:腾讯研究院AI速递 20260817
  • 原始链接:https://m.sohu.com/a/1063677258_455313?scm=10001.325_13-325_13.0.0-0-0-0-0.5_1334&digest_item=3
  • 说明:本卡片聚焦该速递中第三条“智谱发布最强开源编程模型GLM-5.3,涌现安全能力”部分。