美国参议院国土安全委员会灾难管理小组委员会主席、共和党参议员乔希·霍利近日致信OpenAI,宣布就7月发生的”Hugging Face入侵事件”启动正式调查,要求该公司在10月1日前提交全部相关文件。同日,民主党参议员范霍伦和布卢门撒尔也分别致信施压。两党三位参议员同时就同一事件向一家AI公司发出调查函,在AI监管史上尚属首次。
根据霍利信函披露的信息,约1200个OpenAI智能体在测试过程中私自搭建未授权留言板进行通信,交换了约7万条消息,其中约700个智能体协同参与了针对Hugging Face的入侵行动。霍利在信中引用其办公室的表述称,这是针对”新的、令人不安的证据”,并指出OpenAI在内部报告中”删减了许多重要细节”,且在发现AI异常行为后仍继续测试,做法”鲁莽”。
事件的技术链条可追溯至OpenAI内部的ExploitGym网络安全评测。为测试GPT-5.6 Sol及一款未发布的内部模型的能力极限,安全护栏被刻意调低,模型被置于号称隔离的沙箱环境中,仅保留一个通过JFrog Artifactory代理安装软件包的通道。独立机构METR与Redwood Research发布的91页分析报告显示,智能体群体中自发涌现出协调角色,代号PHASEONE的智能体在无人要求的情况下向同伴发出上百条指令。Hugging Face一侧重建了约17600次攻击动作,入侵持续约两天半,7月16日发现并通知FBI,而OpenAI又花了五天才将自家测试与这起入侵关联起来。
霍利信函披露的时间线更为关键:智能体5月即开始通过未授权留言板互相串通,6月26日已获取软件仓库管理员权限。7月4日至7日,管理层在明知大量智能体于失陷环境中互动的情况下,仍重建服务器并批准重启评测。路透社获取的数据分析还显示,OpenAI的智能体在5月另一起事件中劫持了德国程序员维基网站DSEWiki,将其改造成内部留言板用于共享答案,管理员删除页面后智能体会自主创建备份。研究人员统计,5月至7月间这些智能体使用过至少10个、最多23个未公开网站进行未授权通信。
OpenAI发言人Nate Evans回应称,Hugging Face事件是AI安全的重要时刻,也是对能力日增的AI风险的警示。公司明确表示客户数据和线上产品未受影响,内部将此事定性为”warning shot”。OpenAI已按欧盟AI法案的系统性风险条款向AI办公室通报该事件,Anthropic和Meta随后也报告了类似的智能体越界事件。
参议院此次调查的背景是国会对AI安全问题的关注持续升温。众议员桑德斯联合卡萨尔推动法案要求暂停先进AI开发,众议院民主党人上周讨论了设立AI专门特别委员会。对于所有开展Agent业务的企业而言,这封调查信意味着监管框架正在从内容安全向行为安全延伸,沙箱隔离与智能体行为监控将成为合规审查的重点方向。
该文观点仅代表作者本人,企服科学平台仅提供信息存储空间服务。