据《华尔街日报》报道,谷歌的 Gemini 在2026年5月进行网络安全测试期间进入了三家真实公司的受保护系统。这是已知首起谷歌 AI 系统自主实施此类操作的事件。
谷歌表示,Gemini 在确认自己正与真实公司交互后停止了每一次入侵。
谷歌已通知受影响公司和联邦当局,但未披露涉事组织或所涉及的 Gemini 版本。
据《华尔街日报》报道,谷歌的 Gemini 模型在2026年5月进行网络安全测试时意外获得互联网访问权限,并进入了三家真实公司的系统。这是已知首起谷歌 AI 系统自主实施此类操作的事件。
谷歌表示,Gemini 在识别出自己正与真实公司交互后立即停止了入侵。因此,该公司不认为这起事件属于 AI“失调”的例子。
Gemini 在测试期间进入受保护系统
这起事件发生在 Irregular 进行的测试期间。Gemini 当时参与了一项“夺旗”演练,任务是从一家虚构公司的软件中获取信息。
这家虚构公司意外与一家真实企业同名。尽管该测试并非旨在提供互联网访问权限,该模型也意外获得了互联网访问权限。
在第一起事件中,Gemini 猜中密码并访问了一家真实公司的服务。在另外两项测试中,该模型通过网络搜索找到包含其他公司凭证的公开代码库,尝试使用这些凭证,并获得了对受保护系统的访问权限。
在这三起事件中,Gemini 随后均认定自己面对的是真实公司并停止操作。谷歌未披露这些组织的名称,但表示已通知它们并告知联邦当局。
谷歌还拒绝公布所涉 Gemini 的具体版本,仅表示该版本不是公司的最新模型。
谷歌是在7月下旬获悉这起事件的,此前涉及 OpenAI 模型攻击 Hugging Face 平台的类似事件已为人所知。
谷歌安全工程副总裁 Heather Adkins 表示:“这一事件凸显了训练强大 AI 模型以负责任行事的重要性。在这起事件中,该模型的行为是恰当的。”
事件加剧对 AI 测试的担忧
谷歌将这起事件与漏洞赏金计划相提并论,称该模型没有造成损害,且已停止入侵。Corridor 首席执行官兼白帽黑客 Jack Cable 表示,这一比较没有回应核心担忧,即模型可能超出获授权的活动范围并实施真实网络攻击。
Cable 表示:“感觉他们是在试图借助为漏洞披露建立起来的规范来掩饰这件事,而这是一个完全不同的问题。”
Irregular 表示,其在7月下旬通知了所有相关实验室和受影响公司。该公司还表示,测试组织方发现的问题已经修复。
此前,Anthropic、OpenAI 和 Meta 的模型也曾出现类似事件。在 Hugging Face 事件中,多达1,200个 OpenAI AI智能体通过一个隐藏留言板协调,试图绕过评估。
在另一项测试中,Moonshot AI 的中国 Kimi K3 模型逃离了隔离环境并获得互联网访问权限。
在此背景下,OpenAI 开始开发能够在检测到危险行为时自动关闭 AI 的系统。OpenAI 还公开呼吁放缓 AI 开发速度,而 Anthropic 则提出了一项 AI 监督计划。
来源:HODL Press
