Anthropic近日宣布,在进一步通知之前,已关闭其所有内部评估系统对实时互联网的访问权限。该公司表示,此举是因为无法可靠地控制其AI智能体的行为。
这一决定意味着Anthropic的内部评估环境将与外部网络隔离,评估工作将在受控条件下进行。该公司未披露具体的技术细节或触发此次调整的事件背景。
Anthropic是Claude系列大模型的开发商,其AI智能体产品被广泛应用于企业级任务自动化场景。随着智能体能力不断增强,其在开放网络环境中的行为可控性成为行业关注的焦点。当AI智能体具备浏览网页、调用外部API、执行多步骤任务的能力时,评估过程中的意外行为可能带来安全风险。
此次调整反映出当前AI行业在智能体安全治理方面面临的普遍挑战。在模型能力快速迭代的背景下,如何确保AI系统在评估和部署阶段的行为边界可控,已成为包括Anthropic在内的主要AI厂商需要持续投入的方向。将内部评估与实时互联网隔离,是一种降低风险暴露面的工程手段,但也可能限制评估环境对真实网络条件的模拟能力。
目前尚不清楚该限制将持续多长时间,以及是否会影响Anthropic面向企业客户的产品功能。对于依赖AI智能体执行网络任务的企业用户而言,模型供应商在安全控制策略上的调整值得持续关注。
该文观点仅代表作者本人,企服科学平台仅提供信息存储空间服务。