Anthropic 正在扩大一项面向网络安全专业人员的模型测试计划,允许经过审核的安全团队在更低安全防护限制下使用其能力最强的人工智能模型。该公司于当地时间周二正式公布新版网络核验计划(Cyber Verification Program,简称 CVP),将过去半年运行的两套项目整合为统一框架。
该计划的前身之一“玻璃翼计划(Project Glasswing)”主要面向负责关键软件安全防护的机构,开放 Claude Mythos 模型系列的使用权限。据 Anthropic 披露,4 月至 7 月期间,合作方至少发现并核实了 129000 个软件漏洞。此外,公司自身开展的开源扫描工作在 4 月至 10 月间额外发现 5500 个漏洞。截至目前,超过 33000 个漏洞被评定为严重或高危等级。Anthropic 表示,上述数据来自对有限数量合作方的调查,实际影响可能至少为当前统计的五倍。
另一前身为旧版网络核验计划,向经过资质审核的安全团队开放防护限制下调后的 Claude Opus 及 Claude Sonnet 模型。新版 CVP 共分为三个层级,每个层级均设有对应的资质审核要求与安全管控措施。三个层级均可使用 Claude Opus 5.5、Claude Sonnet 5.5、Claude Mythos 5.1 以及后续推出的新模型。
其中,防御层级适用于事件应急响应、恶意软件分析等工作,安全团队、关键基础设施运营方、开源项目维护人员以及拥有漏洞上报履历的研究人员均可提交申请。红队层级在防御层级基础上增加授权渗透测试与红队攻防演练权限,仅接受机构申请。专项层级的约束最少,仅面向一小部分机构开放,获准对电网、航空飞行系统、银行跨行转账基础设施等关键系统开展测试。原有玻璃翼计划成员将归入该专项层级。
Anthropic 表示,会与美国政府一同审核每一名参与成员的资质。该公司在今年 4 月发布 Claude Mythos Preview 时曾引发担忧,即人工智能可能在软件完成安全加固之前就对其发起攻击。此次计划扩围,反映出头部模型厂商正试图在安全能力输出与风险管控之间建立更细化的分级机制。
该文观点仅代表作者本人,企服科学平台仅提供信息存储空间服务。