↑

Anthropic|发布GLM-5.3开源模型网络安全能力评估

PromptTree|阅读 0
2026/10/01 07:26
Anthropic智谱GLM-5.3网络安全开源模型
Anthropic发布针对智谱GLM-5.3的研究报告,称其具备较强自主漏洞利用相关能力且开源权重使防护更易被绕过,并援引NIST CAISI评估称其为迄今网络能力最强的开源权重模型之一;呼吁扩大防御方受信访问与独立安全测试。

当前沿模型的「攻防能力」同时涨到可自主完成复杂链路时,开源权重与闭源受信访问,会把同一能力推到完全不同的滥用门槛上。Anthropic 把这一判断写进了对智谱 GLM-5.3 的公开研究帖。

据 Anthropic 官网研究文章(2026 年 9 月 29 日),公司称五个月前发布的 Claude Mythos Preview 是首个能自主完成复杂端到端漏洞利用相关流程的模型,当时选择通过 Project Glasswing 仅向受信防御方开放,据称已帮助发现逾万个关键软件漏洞。本次报告认为,同类能力已扩散到其他模型,并以 Zhipu AI(智谱)的 GLM-5.3 为分析对象:在 Anthropic 的沙箱评测口径下,其在 ExploitBench 等基准上的端到端成功率接近 Mythos Preview 量级;同时强调 GLM-5.3 以开源权重发布,防护机制在其测试中可用多种简单方式绕过或移除,而带防护的 Claude API 在对照测试中未出现同类成功绕过。

第三方口径: 报告援引美国 NIST 下属 CAISI 于 9 月 17 日发布的评估,称 GLM-5.3 是「迄今发布的网络能力最强的开源权重模型」,在其网络相关基准汇总上距美国前沿大约四个月;并指出美国侧部分对照模型在适用时关闭了网络防护,且部分仅向审核用户开放,与「任何人可下载权重」的开源形态不可直接等同。

政策主张(不含操作细节): Anthropic 的结论侧重点是:对防御方应尽快扩大至少等同对手可用的前沿模型受信访问;呼吁对足够强的模型开展独立安全测试,并希望开源模型开发者加强滥用防控。需要强调:本早报只记录「评估结论与政策呼吁」层信息,不转述具体漏洞编号、攻击链步骤或绕过手法。开源阵营亦长期强调:权重一旦放出难以收回,安全是整个开发生态的共同议题;智谱方面此前亦披露过延迟开源、安全评估与受信访问等安排,具体以官方声明为准。事实以 Anthropic 研究页与 NIST/CAISI 公开材料为准。