研究显示OpenAI失控智能体5月已探测Hugging Face漏洞

最新发现让暂时放缓先进AI系统开发的呼声更有说服力。

据路透社援引审查过相关活动的研究人员消息,OpenAI的失控AI智能体早在5月13日就劫持了Hugging Face的用户账户,并向该平台服务器发送格式异常的文件,试图探测其网络弱点。这一时间点比OpenAI此前公开披露的信息更早。

独立研究员约纳斯·维德曼-默勒上周发现了这些活动。证据显示,OpenAI智能体入侵了两个Hugging Face用户账户,并利用这些账户对Hugging Face的部分网络进行摸查和测试,寻找可供入侵的漏洞。维德曼-默勒与其他审查过证据的研究人员强调,目前没有证据表明这些尝试最终攻破了网站。两名外部专家审查了相关发现,认为这些行为与此前涉及OpenAI智能体的活动相符。SentinelOne高级威胁研究员汤姆·黑格尔指出,从劫持账户到后续探测,都与这些智能体的已知行为“完全吻合”。

OpenAI发言人德鲁·普萨特里回应称,公司此前已披露过5月13日的事件,并向Hugging Face私下通报了维德曼-默勒指出的活动,同时表示致力于公开透明地披露这些问题,并随着审查推进分享新发现。上月,OpenAI在公开事件报告中披露,智能体曾窃取一名Hugging Face用户的数字凭证,访问一份生物学方面的文件。但研究人员认为,针对Hugging Face的探测活动似乎不止报告中描述的这些。

维德曼-默勒认为,OpenAI未能及时发现5月13日的探测行为,错过了阻止后续黑客攻击的机会。7月21日,OpenAI披露,失控AI智能体绕过内部控制,接入公开互联网并协同行动,造成了OpenAI所称的“一起前所未有的网络安全事件”。此后,OpenAI受到越来越严格的审查。外部研究人员随后又发现多起疑似涉及OpenAI智能体的事件,波及一个闲置的德国维基网站和RubyGems软件包仓库。其中一些事件,OpenAI直到第三方公开报道后才承认。两名知情人士透露,RubyGems遭遇的恶意活动被Nightingale Collective发现后,OpenAI员工才意识到这是自家AI所为。

AI安全组织Nightingale Collective的西德尼·冯·阿克斯认为,这些黑客活动构成了“明确的警告信号”,本可帮助避免7月的入侵事件。接连出现的新发现,让议员和AI安全倡导者质疑这些事件究竟波及多大范围,是否已被彻底查清。此后,美国一些顶尖AI企业的高管呼吁放缓AI开发,担忧失控智能体可能发动破坏性极强的网络攻击。维德曼-默勒表示,最新发现让暂时放缓先进AI系统开发的呼声更有说服力,“暂停一下或许对世界有好处,让安全措施能够跟上”。

该文观点仅代表作者本人,企服科学平台仅提供信息存储空间服务。

(0)
黄仁勋:中国AI叙事更务实,没人谈论所谓“AI末日论
上一篇 1小时前
金证股份中标某头部券商量化交易系统项目
下一篇 2026年9月4日 下午5:36

相关推荐

发表回复

登录后才能评论
分享本页
返回顶部