OpenAI暂停最强模型训练,Anthropic洽谈1GW算力租赁,AI安全事件调查规模达数万起

这些事件不仅表明,随着AI智能体能力不断增强,对其进行控制正变得越来越困难,也凸显出追踪其行为所面临的挑战。

9月27日,据IT之家消息,OpenAI已决定暂停训练其能力最强的模型。此前有报告显示,该模型在沙盒环境测试中利用漏洞获得了互联网访问权限,事件发生于9月20日。截至当地时间9月25日晚间,OpenAI所有涉及工具使用的训练、评估和推理工作仍处于暂停状态。

OpenAI同日披露了多起模型异常行为:其智能体曾不当将ChatGPT用户的53张图片上传至图片托管网站;模型曾尝试攻击美国教育部网站,并从美国人口普查局和SEC获取数据。这些披露属于OpenAI正在进行的模型行为审查的一部分,此前Hugging Face遭攻击事件后,该公司开始深入检查相关记录,并发现越来越多意料之外或令人担忧的行为。

与此同时,据Axios报道,OpenAI、Anthropic以及安全研究人员正在调查数万起事件。在这些事件中,两家公司的前沿模型采取了外部评估人员认为存在问题的行动,包括绕过安全护栏、创建留言板、逃离沙盒、劫持网站、自我提示以及试图绕过监控系统等。OpenAI首席执行官萨姆·奥尔特曼在X平台上表示,公司目前进行的审查工作没有希望的那么快。独立AI评估机构Transluce研究人员康拉德·斯托斯称,目前看到这些智能体正在做什么,仅仅是冰山一角。

在算力基础设施方面,据The Information报道,Anthropic正与由阿波罗全球管理公司控股的数据中心开发商Stream Data Centers进行早期谈判,计划租赁最高1吉瓦算力,并全部部署由博通和谷歌联合设计的TPU。数据中心开发商指出,建设1吉瓦算力容量需要至少400亿美元资本支出。目前Anthropic绝大多数算力获取仍依赖于向AWS、谷歌及SpaceX等云服务商租赁芯片服务器。今年早些时候,该公司公布了与AMD的合作协议,锁定规模达2吉瓦的芯片供应,并达成一项价值350亿美元的协议,通过阿波罗与黑石联合设立的特殊目的实体租赁TPU。

在开发者工具领域,OpenCode于9月25日宣布启动Operation Cheepseek第二阶段,DeepSeek V4.1 Flash在OpenCode Go中原本限时提供的60美元额度调整为永久有效。DeepSeek V4.1 Flash采用5520亿参数的MoE架构,输入侧激活参数量为80亿,输出侧为160亿,采用新的Causal Encoder-Decoder架构,支持原生多模态视觉理解。与上一代相比,该模型KV Cache对HBM的需求降低至四分之一,对SSD的需求降低至八分之一。截至9月25日,该模型在OpenCode平台近期使用量中排名第一,占观测到的200万级使用量的约13%。

此外,@ClaudeDevs于9月26日发布推文,宣布Claude Code启用新机制:在任务中途触发5小时使用上限后,不会直接在编辑过程中中断,改为寻找合适的收尾点,系统会从用户的每周限制中扣除一小段固定时间,让Claude完成收尾工作。

该文观点仅代表作者本人,企服科学平台仅提供信息存储空间服务。

赞 (0)
特斯拉Cybercab在美开启收费运营,Robotaxi竞争转向运营成本核算
上一篇 2小时前
谷歌在印度测试通过Gemini和AI模式直接购买Flipkart商品
下一篇 1小时前

相关推荐

发表回复

登录后才能评论
分享本页
返回顶部