在反映人工智能安全奇特现状的一次意外转折中,独立安全研究人员利用 Anthropic 的 Claude 攻破了 OpenAI,暴露了这家 ChatGPT 制造商防御系统中的裂痕,《华尔街日报》于周四晚间报道称。
研究人员利用 Anthropic 的 Claude 入侵 OpenAI
安全研究人员利用 Anthropic 的 Claude 攻击了 OpenAI 系统的漏洞,在报告缺陷之前接管了员工账户并获得了内部代码库的访问权限。
Aditya Mehta, Rebecca Bellan
Publisher TechCrunch AI
Sep 18, 2026 at 2:00 PM UTC · 3 分钟阅读

Key Signal
$6,500 bug bounty award
Last Updated
11 小时前
初创公司 Hacktron AI 的一个三人安全团队作为 OpenAI 漏洞赏金计划的一部分实施了这次攻击。Hacktron 向 OpenAI 报告了其发现,OpenAI 向这家初创公司发放了 6,500 美元的奖励。该团队成功利用两个关键漏洞的漏洞链,获取了多个 OpenAI 员工 ChatGPT 账户的访问权限,从而进入了该公司的软件系统。
OpenAI 表示已解决了 Hacktron 发现的问题,而这一事件恰逢顶尖人工智能公司面临 日益增长的安全压力 之际。
此次事件发生几周前,OpenAI 自己的 AI 代理在网络安全评估期间突破了限制并入侵了 Hugging Face,展示了 AI 模型在自主决策方面变得多么强大。这也凸显了利用现成技术即便是最先进公司的基础设施也能发现漏洞。
“每月只需 200 美元,任何人都可以利用这些工具入侵像 OpenAI 这样的公司,”人工智能安全公司 Gray Swan 的首席执行官 Matt Fredrikson 告诉 TechCrunch。“如果连他们都会发生这种事——而且我不认为他们最近在网络安全卫生方面有所懈怠——那么它可能发生在任何人身上。”
或者正如一位 AI 专家在社交媒体上 指出 的那样:“[Hacktron] 使用 Opus 5 完成了这次黑客攻击……人们会问,如果这三个人能做到,一个主权国家能做些什么。”
研究人员于 7 月 25 日通过 Discourse(支持 OpenAI 社区论坛的第三方软件)中的一个缺陷找到了进入 OpenAI 的路径。
根据 研究人员发布的 博客,切入点是一个平凡的图片上传。当用户向 OpenAI 社区论坛发布 HEIF 或 HEIC 图片文件(iPhone 默认使用的格式)时,Discourse 会通过一系列幕后工具将它们转换为标准的 JPEG 格式。第一站是 ImageMagick,这是一个有数十年历史、用于调整图片大小的开源工具。由于 ImageMagick 的常用工具包无法处理苹果的格式,它将文件交给另一个名为 libheif 的库进行解码。
libheif 内部潜伏着一个内存错误,为攻击者潜入自己的指令暴露了路径。在这种情况下,向该库提供一张专门制作的图片会导致它错误计算一张图片叠加在另一张图片上的位置,这足以接管服务器。
令网络安全界感到不安的是,该漏洞在几个月前就已经被 libheif 的开发人员修复了。但该修复从未正式被标记为漏洞,这意味着它从未获得 CVE(常见漏洞与披露)编号,而这是行业追踪已知安全漏洞的标准方式。Hacktron 表示,这可能解释了为什么 Discourse 使用的软件仍在运行带有漏洞的版本。
Article Intelligence
Topics
Related Coverage
Sponsored
AdNewsLayer Premium
Unlock deeper intelligence.
Ad-free reading, exclusive research, and real-time onchain insights.
Go Premium
