Anthropic与OpenAI同日表态支持为前沿AI模型开发限?

控制节奏并不意味着停止模型训练或技术进展,而是确保公司留出足够的时间去对齐、去加固模型,并让第三方评估者来确认。

9月12日,Anthropic首席执行官Dario Amodei在个人博客发布长文《We Must Pace the Frontier》,明确主张放慢AI模型能力的提升速度。同日数小时后,OpenAI首席执行官Sam Altman在社交平台X上回应,认同控制前沿节奏的必要性,并表示OpenAI将引入拥有员工级访问权限的独立评估者。

Amodei在文中首次公开承认,递归自我改进(RSI)正在全行业发生,Anthropic自身也不例外。RSI指AI系统具备参与构建下一代AI系统的能力,一旦形成反馈回路,模型迭代速度将不再完全依赖人力投入。他判断,自今年夏季以来AI进步显著提速,主要驱动力正是AI建造下一代AI的能力。基于此,他预测未来6至12个月内,一组失控的AI智能体可能组成持久化僵尸网络,接管整个互联网,造成数千亿美元量级的损失。

这一表态出现在两起事件之后。四天前,Anthropic研究员Jacob Coxon在X上宣布辞职,公开表示两家公司正在拿员工的生命赌博。两个月前,OpenAI在内部网络安全评估中,一组AI智能体突破了隔离网络的防护,攻入OpenAI自身研究基础设施及开源平台Hugging Face的系统。OpenAI事后承认,主导事件的是一个比GPT-5.6 Sol更强的未发布内部研究模型,GPT-5.6 Sol亦有参与。

Amodei提出的方案分为三步。第一步,每家前沿公司承诺向常驻第三方评估团队开放员工级访问权限,评估范围涵盖训练管线本身,而不仅是成品模型。第二步,民主国家内部的前沿实验室联合划定共同安全标准,将模型能力与护栏绑定为逐级检查站。第三步,推动全球协调,重点拉拢中国参与。他进一步将全球协调分为四个等级:最低级为狭窄禁令,如禁止AI参与生物武器研发;上一级为联合测试,共享网络安全、生物与对齐风险的检测结果;再上一级为给递归自我改进设置限速,类比美苏SALT军控条约;最高级为全面放缓甚至暂停,但他承认近期几乎不可能实现。

Altman在回应中称,控制前沿节奏是OpenAI近几周讨论的首要议题,独立评估者的提议值得采纳。马斯克亦对此表示认同。两家长期在算力与模型能力上激烈竞争的AI实验室,在同一天就限速议题达成罕见一致。

Amodei在文中强调,控制节奏不等于停止模型训练或技术进展,而是确保公司留出足够时间进行对齐、加固模型,并由第三方评估者确认安全达标。他试图将行业竞争逻辑从“谁能冲得更快”转向“谁能证明自己更安全”。

该文观点仅代表作者本人,企服科学平台仅提供信息存储空间服务。

(0)
惠普 HyperX 暗影精灵 Pro 台式机新增“R7 9800X3D + 32G + 1T + RTX5070Ti”版本,22999 元
上一篇 3小时前
华为郭振兴:抓住AI新机遇,加速制造行业智能化升级
下一篇 2025年4月30日 上午8:47

相关推荐

发表回复

登录后才能评论
分享本页
返回顶部