9月2日,阿里千问宣布其Qwen3.8-Max模型正式升级至0902版本。此次升级围绕编程(Coding)和专业办公(Cowork)两大场景进行了针对性后训练,模型整体性能实现进一步突破,官方称其更适合企业真实复杂任务、科研及长周期任务等应用场景。
在第三方评测平台CodeArena的前端编程总榜中,Qwen3.8-Max-0902版本以1691分的成绩登顶,较此前版本提升22分。该成绩反映出模型在智能体编程能力上的显著进步,具体体现在多步推理、工具调用以及端到端应用生成等维度。CodeArena同时更新的模型性价比榜单(帕累托前沿)显示,Qwen3.8-Max-0902版本每百万Tokens综合平均价格为5美元(约合人民币33.7元),而当前性能排名第二和第三的模型每百万Tokens综合价格分别为20美元(约合人民币134.7元)和12美元(约合人民币80.8元)。新版本在性能领先的同时,API调用成本相较竞品具有明显优势。
目前,Qwen3.8-Max-0902版本已上线千问AI平台,对外提供API服务,并同步接入千问办公、Qoder及千问App,供企业开发者与个人用户使用。这一动作延续了阿里千问在模型能力与商业化落地并行的策略,将最新模型能力快速触达至办公协同、开发者工具等实际业务场景。
从行业视角看,Qwen3.8-Max-0902的发布正值大模型竞争从通用对话能力转向垂直场景深度优化的阶段。编程作为企业软件与开发者工具的核心环节,对模型的代码生成准确率、上下文理解长度及工具调用稳定性提出了更高要求。阿里千问选择在编程和办公两个高频企业场景进行强化训练,反映出其将模型能力与企业实际工作流深度绑定的产品思路。
在定价层面,Qwen3.8-Max-0902以显著低于同类性能模型的单位价格进入市场,这一策略有助于降低企业采用大模型驱动的开发工具与办公应用的门槛。随着模型推理成本的持续下降,企业级SaaS和PaaS服务提供商在集成大模型能力时,将拥有更灵活的定价空间,进而可能推动整个企业服务市场的成本结构变化。
阿里千问此次版本更新还强调了模型在长周期任务处理方面的能力。企业级复杂项目往往涉及多步骤规划、跨工具协作与长期上下文维护,这对模型的稳定性和记忆能力提出了挑战。Qwen3.8-Max-0902在多步推理和端到端应用生成方面的表现,表明其在面对此类任务时具备更强的执行连贯性。
值得注意的是,千问办公和Qoder的同步接入意味着该模型能力已直接嵌入日常办公与开发流程,而非仅停留在API调用层面。这种产品层面的整合,有助于模型在实际使用中持续积累反馈数据,形成能力迭代的闭环。
随着大模型在各垂直行业的渗透加速,模型性能与成本之间的平衡正成为企业选型的关键考量。Qwen3.8-Max-0902在榜单表现和单位定价上的双重优势,或将对国内外大模型市场的竞争格局产生一定影响。未来,模型厂商在提升能力上限的同时,如何进一步压缩推理成本、优化特定场景的适配度,将是决定其市场份额的重要变量。
该文观点仅代表作者本人,企服科学平台仅提供信息存储空间服务。