8月17日,DeepSeek调价方案正式生效。根据官方公布的价格,高峰时段V4 Pro每百万tokens输入(缓存未命中)9元、输出27元,缓存命中输入0.3元;空闲时段对应价格分别为4.5元、13.5元和0.15元。对比8月13日公布的调价前价格,高峰时段涨幅最高达1200%,此前的缓存命中输入价格为0.025元/百万tokens。这一调整使Token定价权之争进入关键节点。
当前市场呈现分化态势。DeepSeek、Kimi凭借高性价比快速获取全球用户,而Anthropic、OpenAI等海外模型厂商遭遇大客户流失,主动降价50%至80%。OpenRouter最新公布的全球大模型调用量榜单显示,排名前列的已是DeepSeek-V4-Flash、小米MiMo-V2.5、腾讯Hy3、DeepSeek-V4-Pro、智谱GLM-5.2等中国模型。相比之下,Anthropic的Claude Fable 5仍为最贵模型,每百万tokens输入10美元、输出50美元。
Token定价权之争本质上是AI商业模式的调整。多位受访业内人士认为,随着Agent承担具体任务,市场正逐步转向按价值付费。飞虎互联一年多前开始探索按结果付费模式,考虑从人力成本集约角度出发,按节省的银行业务人员成本收费,或在风控场景中根据Agent挽回贷款损失的实际成效计费。元熙映阙在为客户定制工作流Agent时采用按结果定价,但实际操作中结果难以统一衡量,同样工具在不同行业经验的用户手中效果差异明显。
Gartner指出,国内客户对按效果或按调用付费仍处于”高关注、低接受”状态。原因包括传统企业预算多为CapEx(资本性支出),习惯采购固定资产,难以适应AI时代弹性、持续的OpEx(运营性支出)模式;以及客户倾向私有化部署,导致数据孤岛问题突出,部署与交付成本居高不下。一家正在搭建Agent产品的软件企业表示,按成本消耗与最终价值核算,价值至少应是成本的十倍左右,才可能获得较充裕的利润空间。
涨价并非DeepSeek独有。2026年3月起,国内外头部大模型厂商集体上调AI算力服务价格30%至50%。智谱率先涨价并三度提价,API定价提升83%,调用量反增400%;字节的即梦一个月涨价三次;腾讯云API输入价格单轮暴涨463%;阿里云部分模型在3至4月单价上调20%至30%。卖方涨价的底气源于商业模式从IaaS向MaaS(模型即服务)的转变,以Token为结算单位,价值尺度更模糊,利润空间更大。
智谱CEO张鹏在解释调价时指出,完成一个任务需要的Token量可能是原来的十倍甚至百倍,长期靠低价竞争不利于整个行业发展。涨价并未劝退用户,而是筛选出了愿意付费的高价值用户,部分开发者表示API价格再涨一倍仍可接受。当前模型厂商已采取分层定价策略,用低价模型承接高频任务,维持旗舰模型的高毛利,例如DeepSeek V4系列的Flash版本和Pro版本;也有厂商通过生态和增值服务建立壁垒,阿里计划对大型商业客户采取收入分成模式,将收费模式从”消耗多少Token”转变为”你用模型赚了多少钱”。
该文观点仅代表作者本人,企服科学平台仅提供信息存储空间服务。