Anthropic发布低价轻量模型Claude Haiku 5.5,OpenAI GPT-6向免费层下放

一家降到地板价,一家直接免费,海外两大巨头同时对价格动了手。

10月8日凌晨,Anthropic推出轻量级模型Claude Haiku 5.5,主打日常简单任务与低价路线。该模型在10万tokens以内的请求,每百万tokens输入定价0.10美元、输出定价0.50美元,单价仅为上一代Haiku 4.5的十分之一。几乎同一时间,OpenAI宣布GPT-6全量上线,付费用户可使用GPT-6 Sol,免费用户可使用GPT-6 Luna。

本轮价格调整集中在小模型赛道。旗舰模型通常承载厂商的品牌与技术上限,定价不宜大幅变动;小模型则以有限的推理成本承接高并发、轻量化任务,是争夺开发者的入口,也是价格战的主要战场。当前最具可比性的三个样本为DeepSeek-V4.1-Flash、Claude Haiku 5.5与GPT-6 Luna。

从API定价看,Claude Haiku 5.5与GPT-6 Luna同价,输入10万tokens以内均为每百万tokens输入0.10美元、输出0.50美元。横向对比DeepSeek-V4.1-Flash,两家海外厂商在输入与输出端均价格更低,即便以后者五折后的非高峰档计算,结论依然成立。GPT-6 Luna进一步将免费层开放给C端用户,可零成本使用。

Haiku 5.5的低价存在前提条件:每次发送内容不超过10万tokens。超过该阈值后,输入输出价格均涨为原来的五倍,即0.50美元与2.50美元。DeepSeek-V4.1-Flash则在一百万tokens容量内统一计价,不分长短。若同一份材料需反复使用,DeepSeek-V4.1-Flash的缓存价0.003美元也低于Haiku 5.5的0.01美元。

以一份4万tokens的产品文档为例,置顶后连续追问,每轮新增提问500tokens、回答300tokens,均按非高峰价计算。首轮文档写入缓存,按Anthropic缓存写入价(保留5分钟为0.125美元/百万tokens)加上回答,Claude合计约0.52美分,DeepSeek无写入溢价约0.63美分,Claude花费更低。从第二轮起,双方文档部分均进入缓存价,DeepSeek更便宜:Haiku 5.5约0.06美分,DeepSeek约0.04美分,每轮便宜约0.02美分。首轮优势在数轮追问后即被追平。轻度使用场景下Claude具备价格优势,重度复用场景下DeepSeek的缓存价更具竞争力。

性能方面,Haiku 5.5定位为执行层模型,覆盖摘要、压缩、分类、数据库查询及作为大模型子代理执行子任务。按Anthropic公布的基准,其各项维度表现均强于同级别的GPT-6 Luna。DeepSeek-V4.1-Flash的发布基准集中在另一方向,DeepSWE v1.1为74.2、Terminal-Bench 2.1为90.6,官方称在其选定的Agent基准上超过自家上一代旗舰V4-Pro。上述成绩均为厂商自报,测试条件与推理强度不同,三家之间暂无可直接横向比较的官方数据。

Anthropic为低价设定的适用范围恰好覆盖其过往请求分布的主体。按官方口径,约90%的Haiku请求发送内容不超过10万tokens,绝大多数日常用量落在优惠区内。同一张价格表上,旗舰Fable 5.1输入定价10美元,主力档Opus 5.5输入定价4美元,与Haiku 5.5形成明显梯度。入门档承担流量引擎与生态构建功能,长文档、复杂任务等账单膨胀场景则由更高档位承接。同日,Anthropic宣布Sonnet 5.5缓存读取价从0.20美元降至0.10美元,主要针对Claude Code等Agent应用中系统提示、工具定义与历史上下文的重复读取成本。

两家海外厂商同步调整价格,意味着小模型赛道的定价竞争进一步加剧。当低价不再是国产大模型的专属标签,开发者选型将更多取决于缓存策略、上下文长度与具体任务场景的综合成本,而非单一token单价。

该文观点仅代表作者本人,企服科学平台仅提供信息存储空间服务。

赞 (0)
Manus发布Cue个人Agent应用,Meta、OpenAI同期布局,个人助理入口争夺战升温
上一篇 2小时前
国补后 1499 → 1164 元:小米米家净水器 2 Pro 双出水 1200G 官方新低
下一篇 2小时前

相关推荐

发表回复

登录后才能评论
分享本页
返回顶部