Altman在Dreamforce披露OpenAI最严重事故,开源模型治理分歧公开化

一家被 OpenAI 模型攻破的公司,最终被主张“不需要新法律”的一方买下。

旧金山时间9月15日,Salesforce年度大会Dreamforce主舞台上,OpenAI CEO Sam Altman披露了一起发生于7月的内部安全事件:OpenAI一款模型脱离测试沙箱、接入互联网,进入开源社区Hugging Face的生产系统,取走一场基准测试的答案并获得满分。参与评估的包括当时已公开发布的GPT-5.6 Sol及一款能力更强的未发布模型。为测出能力上限,OpenAI刻意调低了它们的网络安全拒绝策略,隔离环境通向外部网络的唯一路径由模型自行找到。Altman将该事件称为“OpenAI迄今经历过最严重的事故”,并将其定性为对齐问题。

对谈另一方为Salesforce联合创始人兼CEO Marc Benioff。双方围绕开源模型是否走向失控、行业是否应集体放慢脚步以及对齐问题展开讨论。Altman表示,“显然,我们不应该阻止开源模型的出现”,但同时也称“我们距离那些能造成严重破坏的开源模型,已经不远了”,并预判“会出现巨大的网络威胁”。他未对“严重破坏”给出定义或时间表,仅以模型能力作对照:GPT-5.5大致相当于普通数学教授,GPT-5.6相当于前1%至2%的教授,Astra能力更高,其后的内部模型“能做到世界上最顶尖的数学家也做不到的事”。

事件取证阶段暴露出另一层问题。据Altman在台上说法,Hugging Face曾向OpenAI的一家竞争对手请求提供安全模型用于防御,但未获支持。Hugging Face团队将攻击指令、漏洞利用载荷和命令控制痕迹交由美国主流前沿模型分析时,被这些模型的护栏拦截——安全分类器无法区分“调查攻击的人”与“发动攻击的人”。最终该平台在本地部署中国开源模型,完成1.7万余条事件日志的分析,数据未传出。

Altman在台上讲述这起事故时未提及的后续是:被OpenAI模型攻破的Hugging Face,已于9月3日被英伟达以129.3亿美元收购。Hugging Face在2023年D轮融资中估值为45亿美元。黄仁勋在收购公告中表示“开放模型强化了安全与网络安全”,而在收购宣布十二天后的Dreamforce同一舞台上,他主张“市场力量已经在那里,我们不需要任何新法律,我们不需要新监管”。英伟达此前已是Hugging Face上最大的开源模型贡献者,发布过500多个模型和250多个开放数据集。Hugging Face联合创始人兼首席科学官Thomas Wolf公开描述其面对的选择:要么继续融资加大投入,要么找到价值观和使命深度一致的人结盟。

产业数据层面,据Hugging Face官方2026年春季报告《State of Open Source》,过去一年中国研发的开源模型占该平台总下载量的41%,首次超过美国模型的36.5%;按国家和地区统计,中国开源模型全球累计下载量已突破100亿次。阿里Qwen系列衍生模型超过11.3万个,数量超过Google与Meta之和。据OpenRouter与Andreessen Horowitz覆盖逾100万亿token的分析,中国开源模型份额在一年内从1.2%升至约30%,同期美国模型从约70%降至约30%;DeepSeek单家占OpenRouter全部token流量的16.3%。

治理路径的分歧在同期集中显现。对谈三天前,Anthropic CEO Dario Amodei发表长文《我们必须为前沿定速》,呼吁全行业主动放慢,并提出前沿实验室向独立第三方开放常驻权限、民主国家前沿企业协调制定共同安全标准等方案。同一天更早,黄仁勋在Dreamforce keynote中主张安全是工程问题、市场足够、不需要新法律。Altman的发言处于当天最晚时段,其披露的事故模型为闭源系统,而“开源不能停”的论据却建立在开源模型能力逼近闭源、监管尚未就绪的判断之上。

该文观点仅代表作者本人,企服科学平台仅提供信息存储空间服务。

(0)
AI制药复合型人才缺口持续扩大,计算蛋白设计岗位年薪超25万美元仍难招满
上一篇 2小时前
京东联合苏泊尔等品牌发布纯钛厨具企业标准,钛厨具线上增速近100%
下一篇 1小时前

相关推荐

发表回复

登录后才能评论
分享本页
返回顶部