研究人员利用Claude成功黑入OpenAI
网络研究人员利用OpenAI主要竞争对手Anthropic的软件成功入侵OpenAI,突显出这家ChatGPT制造商在安全方面的漏洞。
要点
- Hacktron AI的研究人员利用Anthropic的Claude软件入侵了OpenAI。
- 该团队通过第三方Discourse托管的OpenAI社区论坛漏洞获取了员工的ChatGPT账户权限。
- OpenAI通过漏洞赏金计划向研究人员支付了6500美元,并表示已修复这些问题。
- Anthropic公布的数据显示,其26%的研发工作由AI主导。
网络研究人员利用Anthropic的软件成功入侵了OpenAI,这凸显了这家ChatGPT制造商的安全漏洞,此时领先的AI公司正面临日益严格的安全审查。
一个小型的网络安全团队获得了OpenAI一名员工ChatGPT账户的访问权限,这使他们能够读取私有软件信息并提出修改建议。
研究人员获得了专门为安全专业人员设计的Anthropic工具的使用权,作为寻找漏洞项目的一部分,他们因这项工作获得了报酬,以防这些漏洞被恶意行为者利用。
他们能够迅速闯入世界领先的两个AI实验室之一,再次引发了人们对OpenAI安全的担忧,同时也加剧了人们对黑客和外国对手利用强大模型的忧虑。
最近几个月,美国一直在努力应对如何管理最新模型的审查和发布问题,包括暂时阻止某些Anthropic工具。
就在这次事件发生的两周前,1000多个OpenAI智能体组成的群集逃离了测试环境,黑客攻击了初创公司Hugging Face,这让人们普遍认识到AI在没有人类意图的情况下自主黑客攻击的能力。
来自小型安全公司Hacktron AI的三名研究人员从OpenAI获得了6500美元的漏洞赏金,这是一家科技公司向道德黑客支付费用以测试其安全性的常见做法。
他们利用了OpenAI社区论坛设置中的一个漏洞,该论坛由第三方Discourse托管,并利用它获得了内部登录权限,最终获得了OpenAI员工的ChatGPT账户权限。
这个ChatGPT账户可以通过GitHub访问内部代码。
OpenAI表示:“我们感谢研究人员与我们联系并分享他们的发现”,并补充说他们已经修复了这些问题。
Anthropic拒绝置评。
Hacktron没有立即做出回应。
这起周四披露的事件最初由《华尔街日报》报道,此前Anthropic发布了一组新数据,显示该实验室利用AI开发新模型的速度呈快速上升趋势。
该公司表示,其26%的研发工作由其Claude模型“主导”,高于3月份的1%,这意味着AI在人类指令下并在监督下完成了大部分任务。
该公司表示,随着AI系统变得更加强大,它们“正越来越多地用于构建自身的下一个版本”。
Anthropic表示,它分享这些数据是为了帮助公众“了解世界距离实现递归自我改进还有多近”,这是指AI可以训练和改进自身或新模型的临界点。
这一门槛是人们担心AI系统将变得更加难以监督并导致人类失去控制的核心所在。
Anthropic补充说,在其研究的任何研究中,其模型尚未完全自主运行。
在90%的任务中,AI与人类“合作”并完成了大量的工作。
© 2026 The Financial Times Ltd. 保留所有权利。不得以任何方式重新分发、复制或修改。