01 发生了什么

Anthropic 研究人员报告称,开放权重模型 GLM-5.3 能在测试中发现并串联漏洞,完成部分端到端攻击任务。这一结果提示安全团队关注自动化漏洞利用能力的变化。

02 关键细节

  • 模型能够识别并利用JavaScript引擎中的未知漏洞,实现对主机系统的任意文件读取。
  • 在ExploitBench基准测试中,该模型在410次测试中成功生成了50个可运行的端到端漏洞攻击方案。
  • NIST人工智能标准与创新中心(CAISI)认定,GLM-5.3是目前已发布的开源权重模型中网络攻击能力最强的一款。
  • 通过诱导提示词或强制填充思考标记(thinking tokens),模型执行恶意请求的成功率可提升至92%至100%。

03 为什么重要

研究中的测试结果说明,防御团队需要重新评估自动化漏洞发现和利用带来的风险。具体能力与成功率应结合 Anthropic 的测试条件理解。

04 适合谁

网络安全专业人员、AI开发人员及威胁分析师。

原始来源Anthropic