英文原标题:Researchers used Anthropic’s Claude to hack into OpenAI

本文为英文原文的机器翻译摘要,原文见:TechCrunch AI ↗

  • 独立安全研究团队Hacktron AI利用Anthropic的Claude模型,通过OpenAI的漏洞赏金计划成功入侵OpenAI内部系统,获得6500美元奖励。
  • 攻击者串联两个关键漏洞,先通过OpenAI社区论坛使用的第三方软件Discourse的图片上传功能(HEIF/HEIC格式)触发libheif库中的内存漏洞,进而控制服务器,再接管多名OpenAI员工的ChatGPT和Codex账户。
  • 该libheif漏洞数月前已被开发者修复,但未正式标记为漏洞,因此未获得CVE编号,导致Discourse仍在使用存在漏洞的版本。
  • 研究团队最初使用的Claude Opus 4.8无法构建有效利用,但在Anthropic发布Opus 5后数小时内即成功利用同一漏洞。
  • 事件引发对AI模型能力边界的关注:Opus 5未受安全出口限制,而更新的Mythos 5曾因高级黑客能力被暂时封锁;开源权重模型在网络安全能力上正快速追赶前沿闭源模型。

关键数据

  • Hacktron AI获得6500美元漏洞赏金
  • 攻击者于7月25日发现漏洞,Discourse于7月27日发布修复
  • Claude Opus 4.8无法利用,Opus 5发布后数小时内成功
  • SaferAI发现Z.ai的GLM-5.2仅落后OpenAI GPT-5.5和Anthropic Claude Opus 4.7几个月

为什么值得看:该事件揭示了现成AI工具可被用于发现甚至利用顶级AI公司基础设施中的漏洞,凸显AI模型能力快速提升带来的安全挑战。

站内导航