Anthropic 发布 Claude Opus 5.5,运行成本较 Opus 5 降低 40%

在 Anthropic 官方的基准测试中,Claude Opus 5.5 在智能编码、计算机使用和知识工作方面保持领先。

Anthropic 于 9 月 23 日正式发布 Claude Opus 5.5 模型,这是其全新 Claude 5.5 家族的首个成员。官方称该模型在大多数工作任务上的表现可媲美 Claude Fable 5.1,同时运行成本较 Opus 5 降低 40%,输出速度提升 30% 以上。

性能提升是此次发布的核心看点。Anthropic 在公告中披露了多项早期测试数据:一名测试人员在不到一天内完成了 68 万行代码迁移,而这一任务按常规预期需要数周时间。在网页应用性能优化测试中,当被要求缩短每个页面的加载时间时,Opus 5.5 在 40 次尝试中成功 39 次,而 Opus 5 仅做出小幅改进,且改变了应用的行为。另一项多模型对比测试中,多个 Claude 模型根据单一提示构建游戏,Opus 5.5 凭借画面表现和完成度获得高于其他所有模型的评分。

安全与对齐方面,Anthropic 表示 Opus 5.5 在其自动化行为审计中取得了迄今所有模型的最高分。该测试套件在数千个模拟场景中对 Claude 进行评估,结果显示 Opus 5.5 采取难以逆转行动或超出既定界限的概率低于其他近期发布的模型,且在抵抗提示注入方面优于 Opus 5。官方还扩大了对齐测试范围,覆盖更长任务、不可能完成的任务以及基于真实事件的场景。

由于 Opus 5.5 在生物学和网络安全领域的表现与 Claude Mythos 5.1 相当,Anthropic 在部署时采取了类似 Claude Fable 5.1 的防护措施。经过审核的机构即日起可申请生命科学验证项目,使用 Opus 5.5 开展生物学研究。未来几周,Anthropic 还将扩大网络验证项目的访问范围,认证的网络安全从业者将能够使用该模型进行工作。

成本结构方面,Opus 5.5 所需的计算量低于 Opus 5。官方测试显示,在默认设置下,Opus 5.5 在典型工作负载中的成本比 Opus 5 低 40%。输入和输出 Token 的价格分别为每百万 Token 4 美元和 20 美元,较 Opus 5 低 20%;缓存命中价格为每百万 Token 0.20 美元,较 Opus 5 低 60%。除降价外,Anthropic 还放宽了 Pro、Max、Team 等企业套餐的使用时间限制,并为订阅用户提供速率限制重置功能,客户可以随时保存和使用。

沟通交流能力上,Anthropic 称 Opus 5.5 的表达比此前模型更为自然。早期测试者反馈其文字更清晰易懂,能够将最重要的信息前置,在长时间训练中成为更好的协作对象。一位测试者的评价是:“它的写作方式和我一样。”

Anthropic 同时确认,Claude Sonnet 5.5 和 Claude Haiku 5.5 将在未来几周内推出,在性能、效率和安全性方面具备许多相同的改进。在 Anthropic 官方的基准测试中,Claude Opus 5.5 在智能编码、计算机使用和知识工作方面保持领先。

此次发布正值企业级 AI 模型竞争加剧之际。降低单位 Token 成本并提升输出速度,直接关系到企业在生产环境中部署大模型的可行性。Anthropic 通过 Opus 5.5 在性能与成本之间重新设定平衡点,同时以安全审计得分和分级防护措施回应企业客户对合规与可控性的关切。随着 Sonnet 5.5 和 Haiku 5.5 的后续推出,Claude 5.5 家族将覆盖从高复杂度任务到轻量级场景的完整产品梯度,其在企业服务市场的实际渗透效果值得持续关注。

该文观点仅代表作者本人,企服科学平台仅提供信息存储空间服务。

(0)
调查显示审计委员会日益关注AI等新兴风险,但成员准备度仍待提升
上一篇 2小时前
Meta承认AI助手Muse与OpenClaw相似并非巧合
下一篇 1小时前

相关推荐

发表回复

登录后才能评论
分享本页
返回顶部