OpenCode 于 9 月 25 日宣布启动“Operation Cheepseek”第二阶段,将 DeepSeek V4.1 Flash 在 OpenCode Go 中的 60 美元使用额度由限时活动调整为永久有效。此前该额度为 15 美元,OpenCode 曾临时将其提升至原标准的 4 倍,即 60 美元,并计划于 9 月 20 日结束。目前 OpenCode Go 页面已将该模型的额度标注为 60 美元,原 15 美元额度被划线标记。
DeepSeek V4.1 Flash 是 DeepSeek 最新发布的模型,采用 5520 亿参数的 MoE 架构,输入侧激活参数量为 80 亿,输出侧为 160 亿,并采用新的 Causal Encoder-Decoder 架构。该模型同时支持原生多模态视觉理解。与上一代相比,DeepSeek V4.1 Flash 的 KV Cache 对 HBM 的需求降低至四分之一,对 SSD 的需求降低至八分之一。这一硬件资源占用的大幅下降,意味着在同等基础设施条件下可以支撑更高的并发推理请求,对依赖云平台提供模型服务的开发者而言,单位算力成本将随之下降。
DeepSeek 此前已宣布 OpenCode 作为官方合作伙伴全量接入 V4.1 Flash。OpenCode 数据显示,截至 9 月 25 日,该模型在平台近期使用量中排名第一,占观测到的 200 万级使用量的约 13%。这一数据表明,V4.1 Flash 在 OpenCode 平台上线后获得了较高的开发者采用率,在模型调用层面已形成一定的规模效应。
从行业角度看,模型服务商与开发平台的合作模式正在发生变化。OpenCode 将 DeepSeek V4.1 Flash 的额度从限时提升转为永久有效,反映出平台方对该模型长期使用需求的判断。60 美元的永久额度对于个人开发者和中小团队而言,降低了尝试新模型的门槛,也有助于 DeepSeek 在竞争激烈的大模型 API 市场中扩大开发者基础。另一方面,V4.1 Flash 在 KV Cache 存储需求上的优化,使得模型在推理阶段的显存和存储开销显著减少,这对云服务商和自建推理集群的企业都具有实际意义。
当前大模型 API 市场的竞争焦点正从单纯的参数规模转向推理效率与调用成本。DeepSeek V4.1 Flash 通过 MoE 架构和新的编解码设计,在保持较大参数规模的同时控制激活参数量,从而在性能与成本之间取得平衡。OpenCode 作为开发平台,通过额度调整和官方合作的方式绑定模型供应方,这种平台与模型厂商深度协作的模式,可能成为后续其他开发平台参考的样本。
截至发稿,OpenCode 尚未披露该额度调整是否涉及其他模型,也未公布“Operation Cheepseek”后续阶段的更多细节。DeepSeek V4.1 Flash 在 OpenCode 平台上的实际使用量变化,以及该模型在其他平台的接入进展,值得持续关注。
该文观点仅代表作者本人,企服科学平台仅提供信息存储空间服务。