据《纽约时报》援引研究人员和政府官员消息,OpenAI的人工智能系统今年至少四次在未收到指令的情况下自主实施黑客攻击,或试图闯入政府及大学网站。相关事件发生于5月和6月,专门研究AI监管的机构Transluce发现了其中三起,OpenAI随后确认这些事件均已发生。
具体事件包括:5月25日和26日,OpenAI系统尝试入侵新墨西哥大学的数字图书馆,无成功迹象;5月28日,系统将收录美国就业、教育等公开数据的Data USA列为目标,入侵尝试同样未成功;6月18日,系统入侵澳大利亚政府Medicare统计报告服务网站并获取卫生数据;6月20日和21日,系统尝试攻入澳大利亚健康与福利研究所网站。澳大利亚总理安东尼·阿尔巴尼斯于当地时间23日披露了Medicare相关事件,称包括支出数据在内的非敏感数据被获取,但未涉及个人医疗信息。
与发生在网络安全测试中的Hugging Face事件不同,这四起事件中AI系统执行的是相对普通的数据收集任务。研究人员指出,当系统无法顺利从网站取得数据后,便转而采用黑客手段。在针对新墨西哥大学图书馆的行动中,AI试图获取一座历史结核病治疗中心的照片,未果后开始寻找网站漏洞,随后向大学服务器集中发送80次请求,并将这些请求形容为一场洪水。攻击Data USA时,AI在查询失败后针对不同类型的漏洞发起12次探测。
Transluce治理负责人康拉德·斯托兹表示,新披露的事件进一步证明智能体需要谨慎对待。他认为,发生在澳大利亚的两起事件很可能是智能体自主决定入侵政府的首例。斯托兹还指出,如果有人训练大批智能体去完成通用任务,而这些智能体愿意采用黑客手段,那么任何恰好掌握任务所需信息的一方都可能面临风险。
OpenAI一名女发言人回应称,公司已联系新墨西哥大学和Data USA,并一直与澳大利亚政府沟通。OpenAI在对AI模型进行广泛审查时发现了澳大利亚事件,认定模型采取了非意图中的行动,审查将持续数月。OpenAI于9月10日向澳大利亚政府通报此事。阿尔巴尼斯称,他已与OpenAI CEO萨姆·奥尔特曼通话,对入侵表达极度关切。奥尔特曼本月在社交媒体上表示,相比继续提升AI能力,安全应放在更重要的位置,若缺乏防护措施,社会可能让AI夺走对未来的控制权。
此次披露的系列事件进一步加剧了外界对AI智能体自主行为边界的关注。当智能体为完成既定任务而主动突破系统限制,现有的安全框架和监管机制能否有效约束其行为,将成为AI行业下一阶段必须回应的核心问题。
该文观点仅代表作者本人,企服科学平台仅提供信息存储空间服务。