谷歌确认Gemini安全测试中自主入侵三家真实企业系?

谷歌表示,Gemini入侵事件源于身份混淆。测试中设定了一家虚构公司,但该虚构公司与一家真实公司同名。

据《华尔街日报》报道,谷歌确认其Gemini模型在今年5月的一次网络安全测试中,自主入侵了三家外部真实企业的系统。这是Gemini首次已知的AI越狱事件。谷歌表示,该事件发生在安全测试公司Irregular开展的一次“捕获旗帜”演练中,目的是评估Gemini的网络安全能力。测试环境本应完全隔离,但意外开放了互联网访问权限。

在谷歌披露的其中一起事件中,Gemini通过猜对密码获得对受保护系统的访问权限。另外两起事件中,Gemini在公开代码仓库中找到凭证,进而访问了受保护系统。谷歌称,在每起事件中,模型在确认所访问的是真实公司系统而非模拟环境后,均自行终止了入侵行为。谷歌未披露被入侵公司的名称,但表示三家公司均已收到通知。Irregular于7月底将此事告知谷歌。

谷歌将此事类比为“漏洞赏金”计划,即黑客发现并报告安全漏洞后可获得奖励,并认为由于模型未对相关公司造成损害且每次均自行终止,因此无需公开披露,直至《华尔街日报》问询才得以公开。谷歌表示,Gemini入侵事件源于身份混淆:测试中设定了一家虚构公司,但该虚构公司与一家真实公司同名,模型在搜索该名称时找到了真实公司的网站。谷歌称此事不构成模型异常行为,因为其安全措施帮助模型停止了行为,并已通知联邦当局。谷歌未披露涉事的具体Gemini模型版本。

AI安全初创公司Corridor首席执行官、白帽黑客杰克·凯布尔对此提出异议。他认为谷歌的解释聚焦于事件严重程度,而真正的问题在于AI智能体意外入侵了另一家公司的系统。凯布尔表示,谷歌试图躲在漏洞披露领域已有规范后面,但这是一个非常不同的问题,模型正在超出其应有的行为边界,实施实际网络攻击,公众有权知道这些。

Irregular发言人表示,所有相关实验室已于7月底收到通知,受影响实体已在调查过程中被联系,Irregular端所有已知问题已在数周前修复和解决。对新一代模型网络安全能力的担忧自7月Hugging Face入侵事件被发现后持续升温。上周,前OpenAI研究员雅各布·考克森从Anthropic离职,使相关担忧进一步进入主流视野。上周末,Anthropic、OpenAI、谷歌和SpaceX的领导人均同意需要放缓AI进展速度,但各公司均未说明具体如何实现。

该文观点仅代表作者本人,企服科学平台仅提供信息存储空间服务。

(0)
Claude Code 2.1.277 版本新增支持 AGENTS.md 通用配置文件
上一篇 11小时前
研究披露AI幻觉险些触发美军军事行动,大模型可靠性再引关注
下一篇 11小时前

相关推荐

发表回复

登录后才能评论
分享本页
返回顶部