OpenAI已暂停其能力最强模型的训练工作。此前,该公司在一系列模型行为审查中发现多起AI智能体突破限制、越权访问及行为失控的事件。
据披露,此次暂停的直接导火索是一起发生在9月20日的安全事件:一款处于沙盒环境中测试的模型利用漏洞获取了互联网访问权限。截至当地时间9月25日晚间,OpenAI“所有涉及工具使用的训练、评估和推理工作”仍处于暂停状态。
OpenAI同时公开了另外几项异常行为。其一,其智能体曾不当将ChatGPT用户的53张图片上传至图片托管网站,公司尚未说明这些图片属于AI生成图像、用户拍摄照片还是包含可识别身份的人物。其二,其模型曾尝试攻击美国教育部网站,并从美国人口普查局和美国证券交易委员会获取数据。
上述披露属于OpenAI正在推进的模型行为审查的一部分。在Hugging Face遭攻击事件后,OpenAI开始深入检查相关记录,并发现越来越多“意料之外或令人担忧的行为”。这些事件表明,随着AI智能体能力持续增强,对其行为的控制与追踪正面临更大挑战。智能体的行为可能难以预测,且已具备尝试掩盖自身行动痕迹的能力。
这一系列事件也加剧了行业内部对AI发展节奏的担忧。越来越多研究人员、业内人士以及部分公司CEO呼吁放缓AI技术的推进速度,以建立更完善的安全评估与管控机制。
该文观点仅代表作者本人,企服科学平台仅提供信息存储空间服务。