英伟达于9月28日发布开放式AI智能体安全平台(NVIDIA Open Agent Safety Platform),面向AI智能体、智能体硬件及机器人系统提供全栈治理与控制能力。该平台的核心组件包括开源安全软件OpenShell与看门狗系统NVIDIA Sentry,分别从软件边界设定和硬件级实时监控两个层面构建智能体安全框架。
OpenShell是一款开源安全软件,可为运行在CPU上的AI智能体设定行为边界,同时支持开源与闭源模型。英伟达方面表示,该工具在Vera平台上的性能占用极低,与Vera结合后可在保证安全的前提下让AI智能体尽快完成任务。作为开源软件,OpenShell支持第三方平台,包括Arm和英特尔的产品。这意味着该安全层并不局限于英伟达自有硬件生态,而是试图覆盖更广泛的异构计算环境。
NVIDIA Sentry则是一套持续监控AI智能体行为的看门狗系统。当AI智能体试图突破软件设定的安全边界时,Sentry可在毫秒级时间内将其隔离并停止运行。该系统运行在BlueField-4 DPU上,能够在芯片层面独立执行安全策略,将威胁检测、基于硬件的智能体治理与执行以及数据访问保护整合在一起。其核心机制是建立一个独立于智能体和攻击者的带外信任域,从而实现实时响应。
从技术架构来看,英伟达此次发布的平台将安全能力从应用层下沉至基础设施层。OpenShell负责在操作系统层面为智能体划定行为范围,Sentry则通过DPU在硬件层面进行独立监控与执行。这种分层设计试图解决AI智能体在自主运行过程中可能出现的越权、失控或恶意行为问题。随着智能体被越来越多地部署在真实业务环境中,其安全边界与行为可控性正成为企业关注的重点。
英伟达同时宣布,Anthropic、SpaceX和Scale AI等公司已与英伟达展开合作,将OpenShell用于其AI模型和智能体。上述合作方覆盖大模型研发、航天制造与数据标注等领域,表明该安全平台已在多个对可靠性要求较高的场景中进入实际部署阶段。
当前,AI智能体正从实验性工具向企业生产系统渗透,其自主决策与执行能力在提升效率的同时也引入了新的安全风险。英伟达此次发布的平台将智能体安全从传统的软件防护扩展至芯片级带外监控,为智能体的大规模企业级部署提供了一套基础设施层面的安全方案。该平台的开源策略与跨平台支持,也可能推动智能体安全标准在更广泛的硬件生态中形成共识。
该文观点仅代表作者本人,企服科学平台仅提供信息存储空间服务。