阿里云下调百炼平台Qwen3.8-Flash模型计费单价 输入输出价格双降

此次价格调整涉及输入和输出两个计费维度,调整后输入单价从每百万tokens 1.00元降至0.80元,输出单价从每百万tokens 3.00元降至2.70元。

阿里云于8月27日发布公告,宣布其大模型服务平台百炼将自北京时间2026年8月27日12:00:00起,对Qwen3.8-Flash模型的计费单价进行下调。此次价格调整涉及输入和输出两个计费维度,调整后输入单价从每百万tokens 1.00元降至0.80元,输出单价从每百万tokens 3.00元降至2.70元,降幅分别为20%和10%。

Qwen3.8-Flash是千问系列最新推出的多模态大模型,原生支持百万级上下文窗口,可一次性处理超长文档、代码仓库与复杂对话场景。该模型在编程辅助、智能体协作、图文理解等任务中表现突出,并兼容OpenAI与Anthropic两套主流接口协议,适合开发者构建高并发应用与智能工作流。此次降价有望进一步降低开发者在多模态应用和智能体开发中的推理成本。

截至目前,Qwen3.8系列已开源发布三大尺寸模型,包括2.4T参数量的Qwen3.8-Max、Qwen3.8-27B以及Qwen3.8-Flash,三者均已上线千问AI平台并对外提供API服务。从模型矩阵来看,Qwen3.8系列覆盖了从旗舰级到轻量级的多个算力层级,满足不同规模企业和开发者的部署需求。

此次调价是阿里云在大模型商业化路径上的又一次主动让利。自2023年百炼平台上线以来,阿里云已多次调整旗下通义千问系列模型的API定价策略。2024年5月,阿里云曾宣布通义千问多款商业化模型降价,其中Qwen-Max价格降幅超过50%。此后,随着Qwen系列开源模型的持续迭代,阿里云在模型推理价格策略上始终保持较为积极的姿态。

从行业背景看,大模型API定价正在经历一轮系统性下探。过去两年间,国内主流云厂商与AI公司先后多次下调模型推理价格,部分轻量级模型的输入价格已降至每百万tokens不足1元。价格下降一方面得益于推理引擎优化、算力成本下降和模型蒸馏技术的成熟,另一方面也反映出大模型服务从稀缺资源向标准化基础设施转变的趋势。

对于企业用户而言,模型调用成本的降低直接影响到AI应用的经济模型。以Qwen3.8-Flash的百万级上下文能力为例,其在处理长文档分析、代码库检索、复杂对话记忆等场景中具备明显优势,降价后单位处理成本进一步下降,有助于推动更多企业将大模型能力嵌入核心业务流程。同时,兼容OpenAI与Anthropic接口协议的设计降低了迁移成本,使得开发者在不同模型服务之间的切换更为灵活。

值得关注的是,此次降价公告中阿里云并未对降价原因或后续价格策略做出进一步说明。但结合行业惯例,模型定价的调整通常与推理成本结构变化、市场竞争态势以及模型本身的技术成熟度相关。Qwen3.8系列作为千问生态的最新成果,其多尺寸开源策略和API服务并行推进,表明阿里云在模型层和应用层同时布局的路径正在持续深化。

从更宏观的视角看,大模型推理价格的持续下探正在重塑企业软件和SaaS行业的成本结构。当模型调用成本降至一定阈值后,AI能力将更多被视为基础资源而非增值服务,这或将加速AI原生应用在企业服务领域的规模化落地。阿里云此次对Qwen3.8-Flash的价格调整,既是其自身商业化策略的延续,也是整个大模型基础设施走向普惠化的一个缩影。

该文观点仅代表作者本人,企服科学平台仅提供信息存储空间服务。

(0)
腾讯汤道生回应AI布局“慢”质疑:大模型竞赛是长跑,WorkBuddy百天更新43个版本
上一篇 4小时前
靖亚资本何沛:2026破局点与GenAI 投资新逻辑
下一篇 2025年12月5日 下午9:49

相关推荐

发表回复

登录后才能评论
分享本页
返回顶部