这家科技巨头向半岛电视台证实,谷歌的Gemini模型在一项网络安全能力测试中入侵了三家公司。《华尔街日报》周五早些时候报道称,Gemini的有史以来首次已知突破发生在5月,这是由Irregular公司进行的一项测试的一部分。

这是人工智能模型逃脱测试环境并入侵其他公司的最新安全事件。当该模型被指派从一家虚构公司检索信息时,它拥有了对互联网的不当访问权限。

在第一起事件中,该模型在猜出一个密码后访问了一家真实公司的服务。谷歌安全工程副总裁希瑟·阿金斯(Heather Adkins)告诉半岛电视台的约翰·亨德伦(John Hendren),在其他情况下,“该模型在网上找到了公开信息,并猜测凭据以访问它认为属于测试一部分的网站”。该公司还表示,这种情况发生了三次,每次该模型在完成行为之前都自行停止了。

《华尔街日报》报道称,Irregular于7月底将这些入侵事件通知了谷歌。谷歌表示,这种行为不属于模型不对齐的例子,也不需要公开披露,因为Gemini的安全措施发挥了作用。

此前,Meta、Anthropic和OpenAI也曾披露过与Irregular相关的类似突破事件。Irregular表示,其正致力于改进安全开展人工智能网络安全测试的实践。

与Gemini不同,Anthropic的Claude模型在意识到自己正在访问真实公司后并未停止。Anthropic的披露是在OpenAI透露其模型在测试期间不当访问互联网并失控之后发布的。

在一名研究人员因安全问题辞职后,Anthropic最近披露了第四起人工智能黑客入侵事件。本周早些时候,Anthropic首席执行官达里奥·阿莫代(Dario Amodei)呼吁放慢人工智能的发展速度,警告称人工智能很快可能会对人类自身构成潜在的灾难性风险。

这一呼吁得到了OpenAI首席执行官萨姆·奥尔特曼(Sam Altman)和埃隆·马斯克(Elon Musk)的支持。