2026-09-18 18:42 1003 次浏览

Claude化身入侵工具:OpenAI漏洞赏金计划遭AI反向利用

安全研究人员借助Anthropic的Claude模型,通过OpenAI漏洞赏金计划获取员工ChatGPT账户权限,读取并修改私有软件缓存,获6500美元赏金。事件凸显AI工具被用于攻击的复杂风险,OpenAI已修复漏洞并调整令牌策略。

AI代理攻击潮未平,OpenAI反成被入侵目标

人工智能驱动的网络入侵正从理论警告变为接连发生的现实。在AI代理突破OpenAI系统防线并攻击Hugging Face两周后,这家ChatGPT开发商再次发现了一起由AI工具主导的入侵事件——而这一次,被瞄准的是OpenAI自身。

据披露,一组独立安全研究人员利用Anthropic开发的Claude软件,成功获得了一名OpenAI员工的ChatGPT账户权限,进而读取并修改了该公司私有的软件缓存内容。该团队当时正参与OpenAI运营的漏洞挖掘计划,该计划为研究人员提供安全环境,允许其尝试攻破企业系统。发现漏洞后,团队迅速向OpenAI报告,并获得了6500美元赏金。

漏洞细节与官方回应

OpenAI表示,研究人员发现了两个独立问题:其一是托管OpenAI社区讨论论坛的第三方服务Discourse存在漏洞,其二是公司自身系统的问题。目前这两个问题均已得到解决。

OpenAI在回应中称:“我们感谢研究人员与我们联系并分享他们的发现。我们已缩小社区登录令牌的权限范围,并撤销了受影响的令牌和会话。”Anthropic方面则拒绝就此事发表评论。

此次事件并非孤例。近期科技巨头与安全研究人员接连曝光了一系列借助AI工具实施的网络攻击,尽管业界数月来不断警告AI系统的强大能力,但计算机系统日益增加的复杂性使得防御变得极为困难。

行业背景与安全趋势

就在上周六,OpenAI首席执行官山姆·阿尔特曼及其同行呼吁暂停人工智能开发,认为当前发展速度过快,导致开发技术的企业难以安全应对潜在危害。本周三,OpenAI披露了此前未公开的安全事件,并宣布新政策,说明未来将如何报告此类问题。

从漏洞赏金计划被反向利用,到AI模型成为入侵工具,安全边界正变得模糊。当攻击者与防御者共享同一套AI能力时,平台方需要更快的响应机制与更细粒度的权限控制。OpenAI此次的令牌权限调整,或许只是AI安全攻防战中的一个微小注脚。