据多位开发者爆料,Anthropic 旗下新一代中端模型 Claude Sonnet 5.5 已进入发布前最后阶段,并已在 Claude Code 中开启灰度测试。该模型的专属配置标识符「claude-sonnet-5-5」已被发现出现在前端 artifact 配置文件中,意味着模型已完成服务器端部署。此前 Anthropic 在 9 月 22 日发布 Opus 5.5 时曾于官方文档中预告,Sonnet 5.5 与 Haiku 5.5 将在未来几周内推出。
根据开发者 @notjazii 的爆料,Sonnet 5 约在一周前已被悄悄路由至 5.5 版本进行暗测。用户可通过在 Claude Code 中关闭联网与记忆功能后提问特定测试问题来验证是否已被灰度覆盖,部分账号经实测确认已切换至新版本。
在编码与 Agent 能力的多项对比测试中,Sonnet 5.5 表现出显著提升。开发者 @notjazii 发布的前端 UI 动画生成对比显示,在相同提示词下,Sonnet 5.5 生成的动效在代码直觉与视觉呈现上优于 OpenAI 的 GPT-6 Sol 和 GPT-6 Astra。开发者 @chetaslua 使用三个提示词对 Sonnet 5.5 与 GPT-6 Sol 进行六次并行编码测试,结果显示 Sonnet 5.5 生成文件体积为 90 至 131 KB,全部运行触及 90 分钟上限;GPT-6 Sol 生成文件体积为 20 至 29 KB,耗时 9 至 12 分钟。@chetaslua 评价称,Sonnet 5.5 在 Ultracode 模式下效率极高,并恢复了 Sonnet 4 时代较为自然的代码生成风格。
爆料人 @srikanthvaluri 与 @buildwithrajath 综合早期实测后指出,Sonnet 5.5 的表现远超预期。虽然 GPT-6 Astra 在打磨度上仍保有微弱优势,但 Sonnet 5.5 已直接逼平 Astra,在某些高级编码和 Agent 能力上亦逼近其水平。
定价方面,据透露 Sonnet 5.5 的输入价格为每百万 token 2 美元,输出价格为每百万 token 10 美元,缓存读取价格为每百万 token 0.20 美元。该定价与 OpenAI 近期推出的低价模型 GPT-6 Sol 和 Luna 处于同一区间,但性能表现更为突出。开发者 Rajath Gowda 表示,如果 Sonnet 5.5 的性能接近 Opus 5.5,Anthropic 将把前沿 AI 能力变得极度廉价,这是 OpenAI 最需要担心的问题。
从产品布局来看,Anthropic 的策略已较为清晰:以 Opus 5.5 定位高端市场,以 Sonnet 5.5 凭借性价比覆盖中端与日常开发场景。近两周内,Anthropic 还发布了包含超过 2000 个插件的 Claude Marketplace,并在科研领域取得多项成果,包括 Claude 计算出物理学九圈振幅打破世界纪录以及发现未知生物酶系统。
发布时机方面,OpenAI 年度开发者大会 DevDay 定于本周二举行。Sonnet 5.5 选择在此节点前后进行灰度测试并快速推进发布,被业界视为 Anthropic 对 OpenAI 的直接竞争举措。此前在 OpenAI 发布 GPT-6 Sol 和 Luna 的同一天,Anthropic 即推出了 Opus 5.5,性能较前代提升的同时成本降低 40%、速度提升 30%。截至发稿,Anthropic 尚未就 Sonnet 5.5 的正式发布时间作出官方声明。
该文观点仅代表作者本人,企服科学平台仅提供信息存储空间服务。