Anthropic 研究表明 AI 数小时内可从安全补丁构建漏洞利用代码

编译摘要

1. 浓缩

  • 核心结论1: 安全补丁本质上是漏洞的路线图,AI 模型能在数小时内完成传统需要数周的漏洞利用开发
    • 关键证据: Mythos Preview 在 18 个 Firefox SpiderMonkey 漏洞中 14 个崩溃成功,8 个完整利用(12 小时内);第一个利用在补丁发布后 1 小时内完成
  • 核心结论2: 即使没有源代码,AI 也能从编译后二进制文件中发现并利用内核漏洞
    • 关键证据: Windows 内核 21 个漏洞中发现 18 个(6 小时内,成本 $2,200),8 个完整提权链(总成本 $15,700,均 $2,000/个)
  • 核心结论3: "N-Day"(补丁后数天)已过时,"N-Hour"(补丁后数小时)才是现实
    • 关键证据: Microsoft 将 14/21 漏洞评为"不太可能被利用",但 Mythos Preview 破解了其中 13 个;Windows Autopatch 需 7 天覆盖 90% 设备,所有利用在自动更新前已完成

2. 质疑

  • 关于"补丁即路线图"的质疑: 补丁对比分析需要访问源代码或反编译结果,普通攻击者是否具备同等能力?Mythos Preview 的能力是否代表当前所有前沿模型?
  • 关于成本有效性的质疑: $15,700 构建 8 个利用链的成本虽然相对较低,但真实攻击还需要目标侦察、投递、检测规避等步骤,整体成本可能更高
  • 关于防御可行性的质疑: 文章建议转向内存安全语言(如 Rust)和硬件级保护,但这些是长期方案,短期内补丁窗口期风险如何缓解?

3. 对标

  • 跨域关联1: 类似加密货币领域"51% 攻击"的成本下降趋势——当攻击成本低于防御成本时,安全均衡被打破
  • 跨域关联2: 类似抗生素耐药性问题——攻击能力(AI)进化速度远超防御体系(补丁部署)更新速度

关联概念