小米启动MiMo-V2.5系列模型下线,V2.6系列承接全部调用请求

在同等智能水平下,MiMo-V2.6系列价格仅为海外模型的1/20至1/60,这一定价策略延续了小米在大模型API市场的高性价比路线。

小米于10月9日发布MiMo-V2.5-Pro与MiMo-V2.5模型下线通知,宣布随着MiMo V2.6系列全面上线并稳定运行,建议开发者尽快迁移至推理能力更强、性价比更高的新模型。根据通知,MiMo-V2.5-Pro将替换为MiMo-V2.6-Pro,MiMo-V2.5则替换为MiMo-V2.6-Flash。

下线时间安排分为两个阶段。2026年10月14日18:00(UTC+8),待下线模型将自动切换为新版本模型,调用MiMo-V2.5-Pro、MiMo-V2.5的请求将自动转发至对应的V2.6模型,并按照新版模型计价。2026年10月21日10:00(UTC+8),旧模型正式下线,旧版本模型名称失效,调用旧版本模型名称的请求将会收到报错。小米方面提醒开发者务必在截止时间前完成模型替换并充分测试验证。

此次下线通知的背景是小米于9月22日凌晨正式发布并开源了全新的Xiaomi MiMo-V2.6系列,包含Pro与Flash两个原生全模态模型。该系列沿用V2.5系列的API定价体系:Flash版本为每百万词元输入1元、每百万输出2元;Pro版本为每百万词元输入3元、每百万输出6元,并提供99%的缓存折扣。在同等智能水平下,MiMo-V2.6系列价格仅为海外模型的1/20至1/60。

从技术定位看,MiMo-V2.6系列被小米定义为原生全模态模型,Pro与Flash的双版本策略覆盖了不同推理复杂度与成本敏感度的调用场景。Pro版本面向需要更强推理能力的任务,Flash版本则侧重高并发、低延迟的轻量级应用。两者沿用V2.5定价意味着开发者在获得推理能力提升的同时,调用成本并未增加。

在开源模型竞争格局中,小米MiMo-V2.6系列发布时曾超越Kimi K3、GLM-5.3,成为AA指数排名最高的开源模型。AA指数通常用于衡量大模型在多项基准测试中的综合表现,排名变化反映的是模型在推理、编码、多语言理解等维度的能力对比。小米选择将V2.6系列开源,同时通过API提供商业化调用,这一策略与当前国内大模型厂商的普遍做法一致。

从行业影响来看,模型版本的快速迭代与旧版本下线已成为大模型API服务运营的常态。对于依赖MiMo-V2.5系列进行生产环境部署的企业开发者而言,两周左右的迁移窗口期需要完成模型替换、效果验证与成本重新核算。自动转发机制在过渡期内降低了调用中断的风险,但按新版模型计价意味着开发者的账单结构将发生变化。旧模型名称失效后,未及时迁移的请求将直接报错,可能影响线上服务的稳定性。

小米此次下线通知的节奏安排较为紧凑。10月9日发布通知,10月14日启动自动转发,10月21日旧模型彻底下线,整个迁移周期不足两周。这一安排对开发者的响应速度提出了较高要求,尤其是那些将MiMo-V2.5系列深度集成至现有产品流程中的团队。小米在通知中强调“充分测试验证”,也暗示新旧模型在输出行为上可能存在差异,需要开发者重新评估提示词工程与后处理逻辑。

从更宏观的视角看,大模型API市场的竞争已从单纯的参数规模比拼转向推理能力、价格与生态服务的综合较量。小米MiMo-V2.6系列以不变的价格提供更强的推理能力,并维持99%的缓存折扣,这一组合在吸引开发者迁移方面具有一定优势。但模型下线通知本身也提醒市场,大模型服务的版本生命周期管理正在成为企业选型时不可忽视的运营成本。开发者需要在模型能力、调用成本与迁移风险之间建立持续的评估机制。

该文观点仅代表作者本人,企服科学平台仅提供信息存储空间服务。

赞 (0)
GitHub用AI辅助重写将80万行Copilot运行时代码从TypeScript迁移至Rust
上一篇 3小时前
研究显示人类向男性形象AI智能体支付报酬高于女性形象
下一篇 2小时前

相关推荐

发表回复

登录后才能评论
分享本页
返回顶部