Anthropic于近日发布Claude Haiku 5.5模型,这是Haiku系列在今年的首次更新,也是继9月22日Opus 5.5、9月28日Sonnet 5.5之后,Anthropic在大约半个月内补齐的第三款5.5版本模型。此次更新中,Haiku 5.5将短上下文调用的价格下调了90%,同时Anthropic还宣布对Sonnet 5.5的缓存读取价格进行减半调整,并向Claude Max和Team用户每月赠送一定额度的Claude Platform API配额。
根据官方公布的价格信息,Haiku 5.5在10万Token以内,每百万Token输入价格为0.1美元,输出为0.5美元,缓存读取为0.01美元。上一代Haiku 4.5对应的价格分别为1美元、5美元和0.1美元。Anthropic估算,大多数典型工作负载的实际成本大约降低了75%。当Prompt超过10万Token时,Haiku 5.5的价格将调整为短上下文的5倍,即输入0.5美元、输出2.5美元、缓存读取0.05美元。
在基础规格方面,Haiku 5.5的上下文窗口从上一代的20万Token提升至100万Token,最大输出从6.4万Token翻倍至12.8万Token。该模型首次加入Adaptive Thinking和可调节的effort机制,使其在面对复杂问题时可以自主决定是否进行更深层的推理。同时新增Browser Use功能,支持模型直接操作网页,安全机制也更新为新的分类器拒答机制。
Anthropic将Haiku 5.5定位为Claude家族中标准模式下速度最快的模型,适用于低延迟、大量调用的场景,包括实时聊天、客服、语音助手、信息提取、文件整理以及浏览器和电脑操作。在官方列出的典型场景中,将Haiku作为Opus和Sonnet之下的Subagent已被明确纳入核心用途。这意味着在复杂任务中,Opus或Sonnet负责整体结构与判断,而查询具体数据、整理资料、网页操作、信息分类等子任务可由Haiku执行。
这一产品定位与OpenAI近期发布的GPT-6 Luna高度相似,两者均主打高频、大规模、成本敏感的任务,上下文窗口同为约100万Token,最大输出均为12.8万Token。价格方面,Luna在短上下文区间同样为输入0.1美元、输出0.5美元、缓存读取0.01美元。不过两者的长上下文计费策略存在差异:Haiku 5.5在超过10万Token后整档价格变为短上下文的5倍,而Luna在Prompt超过27.2万输入Token后,输入和缓存价格翻倍,输出价格涨至1.5倍,即输入0.2美元、输出0.75美元、缓存读取0.02美元。
性能方面,根据Anthropic公布的测试数据,Haiku 5.5在多项Agent相关任务中表现优于GPT-6 Luna。在电脑操作测试OSWorld 2.1中,Haiku 5.5得分72.4%,Luna为48.9%;Agent Coding测试Terminal-Bench 4.0中,两者分别为39.2%和16.4%;FrontierCode 1.1上分别为46.4%和42.4%。知识工作方面,GDPval-AA v2.1中Haiku 5.5得分1620分,Luna为1437分;AA-Briefcase v1.1中分别为1578分和1336分。在第三方评测平台Artificial Analysis的Intelligence Index上,Haiku 5.5最高档得分为43分,GPT-6 Luna为38分。但在Artificial Analysis的AutomationBench-AA评测中,Luna以53.2%超过Haiku的35.4%。
目前Haiku 5.5已进入Claude的Free、Pro、Max、Team和Enterprise套餐,覆盖Web、iOS和Android平台。开发者可通过Claude API、Claude Code以及AWS、Google Cloud和Microsoft Foundry调用该模型。
除Haiku 5.5外,Anthropic同时宣布将Sonnet 5.5的缓存读取价格从每百万Token 0.2美元降至0.1美元,未注明限时条件。Anthropic估算,由于Agent在长时间运行时会反复读取系统提示词、工具定义和历史上下文,缓存读取在Token消耗中占比较高,此次降价可使大多数Agent任务运行Sonnet 5.5的总体成本再降低约20%。此外,从本周开始,Claude Max和Team用户每月将获得一笔Claude Platform API额度:Max 5x为100美元,Max 20x为200美元,Team根据席位计算,最多可共享500美元。
从产品节奏和定价策略来看,Anthropic正在同时压低Agent任务中“跑腿模型”和“主模型”的使用成本。Haiku 5.5负责高频、低延迟的子任务执行,Sonnet 5.5缓存降价则降低了主Agent长期运行的开销,而API额度的赠送进一步降低了Max和Team用户的综合使用门槛。在上市预期临近的背景下,Anthropic通过密集的产品发布和价格调整,正在模型能力与成本效率两个维度上加大竞争力度。
该文观点仅代表作者本人,企服科学平台仅提供信息存储空间服务。