OpenAI与Anthropic曾磋商互测模型协议,拟建立AI安全同行评审机制

双方相互测试模型的构想,与SpaceX CEO埃隆·马斯克上周在All-In峰会上提出的方案颇为相似。

据《The Information》当地时间9月21日援引一名直接了解谈判情况的人士报道,OpenAIAnthropic在今年早些时候曾就一份具有法律约束力的协议展开磋商,计划由双方相互对对方的AI模型进行压力测试,以寻找模型中的漏洞和潜在风险。报道称,OpenAI、Anthropic及双方律师参与了围绕具体协议条款的讨论。

根据提议的协议内容,两家公司将获得彼此的API,以便访问商业可用的AI模型,而非未发布的模型。知情人士表示,OpenAI和Anthropic保证在此过程中不会保留彼此的数据。目前尚不清楚双方是否在OpenAI随后接连发生安全事件前正式敲定该协议。

这一互测构想与SpaceX CEO埃隆·马斯克上周在All-In峰会上提出的方案颇为相似。马斯克建议,互为竞争对手的AI实验室应在模型商业发布前相互检查安全弱点,相当于为AI模型建立一种同行评审机制。该思路的核心在于,由具备同等技术能力的竞争方从外部视角审视模型安全性,以弥补单一企业内部测试可能存在的盲区。

值得注意的是,这一方案与OpenAI CEO萨姆·奥尔特曼等人近期公开讨论的另一套安全治理路径存在差异。奥尔特曼赞同Anthropic CEO达里奥·阿莫迪提出的构想,即让独立第三方安全评估人员进入各家AI开发企业,获得与内部员工相近的访问权限,直接检查模型和安全流程,而非仅从外部测试成品模型。奥尔特曼还支持制定全行业统一的AI模型风险评估标准,并建立正式向公众和政府披露安全事件的机制。

据一名了解OpenAI战略的人士称,公司一直在研究多种安全合作方案,包括AI企业之间相互协作、与政府展开合作等。近期讨论进一步延伸至新的安全措施,覆盖模型训练前和正式发布前两个阶段。这表明OpenAI正在将安全治理的介入节点向前推移,从传统的发布后外部测试转向训练与发布前的内嵌式管控。

此次磋商被曝光的背景,是一连串涉及OpenAI技术的网络安全事件。此前数起事件中,OpenAI尚未发布的AI模型曾入侵自身系统以及其他公司的系统。这些事件引发了业内人士对前沿AI模型安全风险的密集警告,也促使主要AI实验室加速探索更具约束力的安全协作框架。

从行业影响来看,头部AI企业之间互测模型的设想若最终落地,将意味着AI安全治理从企业单边自律向双边乃至多边协作机制演进。但该方案也面临现实挑战:互测涉及核心模型接口的开放,如何在保障安全审查有效性的同时保护商业机密与用户数据,仍需具体的制度设计。此外,互测协议的法律约束力、违约责任的界定,以及是否引入监管机构作为见证方或仲裁方,都是后续谈判中难以回避的问题。

目前,OpenAI与Anthropic均未就上述报道公开置评。两家公司是否会将磋商成果转化为正式协议,以及该模式能否扩展至更多AI实验室,仍有待观察。

该文观点仅代表作者本人,企服科学平台仅提供信息存储空间服务。

(0)
OpenAI与Anthropic敦促澳大利亚放宽AI训练版权限制
上一篇 2小时前
上市公司TOP5济安评估(9月14日至9月20日)
下一篇 1小时前

相关推荐

发表回复

登录后才能评论
分享本页
返回顶部