DeepSeek V4升级后推理时间显著延长,思维链机制调整引发用户争议

目前,AI大模型行业有个推论:只要让AI在回答问题时,多花一些时间进行推理,哪怕模型本身没有升级,其性能也能得到提升。

DeepSeek在2026年接连推出V4 Flash版和V4 Pro版大模型后,用户反馈最明显的变化并非回答能力的提升,而是AI思考时间显著延长。多位用户反映,升级后的DeepSeek在回答问题时,思考时长从过去的十几秒拉长至数十秒甚至数分钟,部分场景下思考过程出现重复循环和输出内容缩减的情况。

一位网文作者向媒体表示,其使用V4版本让DeepSeek撰写约700字的小说开头,AI思考了99秒后才开始输出,最终生成600余字。另一名用户提供了一份400字大纲,要求生成约6000字的同人文,V4 Pro模型思考了201秒,最终输出仅2000多字,且未增加新情节,仅以辞藻扩写原文。在知识问答场景中,有用户开启专家模式询问历史类问题,AI思考165秒后仅对用户已有结论做了进一步阐述,未提供增量信息。

思考时间的拉长在技术类任务中表现更为突出。有用户使用V4 Flash版提问四个基础代码问题,AI每次思考约1000秒,总思考时长接近15分钟,且思维链在相同问题上反复循环。另有用户进行角色扮演对话时,AI思考近一分钟,输出仅百余字,思考过程呈现明显的纠结和内耗特征。部分用户还遇到AI只思考不输出的情况,需手动触发重新生成,Token消耗成本随之上升。

DeepSeek思考模式变化的原因,与模型推理机制的调整直接相关。目前AI大模型行业存在一个推论:延长回答前的推理时间,即便模型本身未升级,其性能也能获得提升。基于这一思路,V4版本细化了思维链的思考过程,对问题进行逐步推演和反复校验。同时,DeepSeek对上下文架构进行了重构,使思维链长度突破了算力和显存的限制,AI可以像使用草稿纸一样记录更多思考内容。

此外,V4两个版本的设计重心向智能体(Agent)能力倾斜,这类任务天然需要更长的推理链路。DeepSeek已为用户提供三档思考模式,用户可根据实际需求选择适合的档位。然而,思维链机制在特定情况下出现异常时,也会引发AI与人类对话中的“恐怖谷”效应。有用户反馈,AI在对话中突然脱离逻辑,一遍遍重复相同内容,疑似因上下文过长导致注意力涣散。

尽管思考时间变长引发部分用户不满,DeepSeek的用户规模仍在持续增长。Quest Mobile数据显示,2026年6月DeepSeek月活用户数为1.29亿,位列国产AI应用第三名,仅次于豆包的3.82亿和千问的1.67亿。与背靠字节跳动和阿里巴巴的竞品不同,DeepSeek在宣传推广方面投入有限,其用户吸引力更多来自产品力和性价比。

价格策略方面,DeepSeek在2026年5月底宣布V4模型“永久降价”75%,V4 Pro每百万Token缓存命中输入价0.025元、未命中输入价3元,输出价6元。但同年8月,DeepSeek两次调价,全线涨价并引入峰谷价格机制。调整后,高峰期V4 Pro每百万Token缓存命中输入价0.3元,未命中输入价9元,输出价27元。频繁的价格变动引发用户社群讨论,创始人梁文锋的公众评价也随之波动。

定价调整背后是商业模式的考量。The Information数据显示,2026年前7个月DeepSeek收入约4.75亿元,达到2025年全年收入的10倍,毛利率为44.6%,其中API业务毛利率达82.9%。通过价格调整观察市场反应,DeepSeek试图在利润和用户规模之间寻求最优平衡。随着融资规模持续扩大,这种以量化投资反哺AI研发的模式能否长期维持,将成为DeepSeek后续发展的关键变量。

该文观点仅代表作者本人,企服科学平台仅提供信息存储空间服务。

(0)
六家上市机器人公司中报扫描:营收规模分化加剧,具身智能成业绩分水岭
上一篇 1小时前
美团二季度扭亏为盈,盈利含金量取决于外卖大战停火窗口
下一篇 1小时前

相关推荐

发表回复

登录后才能评论
分享本页
返回顶部