安全研究人员利用Anthropic旗下的AI模型Claude,对OpenAI的系统漏洞实施了利用,成功接管了部分员工账户,并获取了一个内部代码仓库的访问权限。研究人员在完成上述操作后,才将发现的漏洞向相关方进行了报告。
这一事件的核心在于AI模型被用于实际的安全攻防场景。Claude作为Anthropic推出的生成式AI助手,在此次测试中扮演了攻击工具的角色,被研究人员用于识别和利用OpenAI系统存在的安全缺陷。攻击路径涉及员工账户接管,进而触达OpenAI的内部代码仓库,表明相关漏洞可能存在于身份认证或权限管理环节。
从行业角度看,该事件反映出当前AI模型在网络安全领域的双重用途属性。一方面,大模型能够辅助安全团队进行漏洞挖掘和渗透测试,提升防御效率;另一方面,同样的能力若被滥用,也可能降低攻击门槛,扩大攻击面。此次研究中,Claude被用于对另一家头部AI公司实施攻击,尤其值得关注。
OpenAI与Anthropic同为全球领先的AI模型开发商,双方在技术路线和产品定位上存在竞争关系。此次安全事件涉及两家公司,但研究人员在获取访问权限后主动上报漏洞,符合负责任披露的常规流程。目前尚不清楚OpenAI是否已修复相关漏洞,以及受影响账户和代码仓库的具体范围。
随着企业加速部署AI工具,模型安全与平台安全之间的边界正变得日益模糊。此次事件为AI基础设施的安全防护提供了新的现实案例,也提示企业在采用第三方AI模型时需同步评估其潜在的安全风险。
该文观点仅代表作者本人,企服科学平台仅提供信息存储空间服务。