在阿里云年度云栖大会上,阿里巴巴CEO吴泳铭披露了通义千问(Qwen)团队的模型演进路线。据其介绍,阿里巴巴旗舰模型Qwen 3.8 Max当前参数规模为2.4万亿,正在训练中的Qwen 4将继续扩大参数规模,而后续的Qwen 4.5与Qwen 5系列计划将参数规模进一步提升至5万亿至10万亿区间。
吴泳铭表示,Qwen团队正持续投入模型架构与数据优化的研究,目标是让模型具备完成更复杂、长周期任务的能力,并最终向人工智能超级智能(artificial superintelligence)方向演进。这一表述将阿里的模型迭代目标从单一的性能提升,扩展至对长周期任务处理能力的系统性攻关。
支撑上述模型规模扩张的是阿里自研的AI基础设施。吴泳铭透露,自研的M890 AI超级节点已能处理参数规模超过2万亿的模型推理任务。而新一代真武V900的性能达到上一代M890的三倍,预计于2027年第一季度实现量产。这意味着阿里在算力硬件层面已为更大参数模型的推理部署做出前置安排。
从行业视角看,参数规模向10万亿级别迈进,对训练集群的互联带宽、推理成本控制以及能耗管理均提出更高要求。当前主流大模型的参数规模多集中在千亿至万亿级别,5万亿至10万亿区间的模型若落地,将在推理基础设施、分布式训练框架等环节带来新的工程挑战。阿里此次同步披露模型路线图与自研超级节点进展,显示出其在模型能力与底层算力两条线上并行推进的策略。
按照披露的时间表,真武V900的量产节点定在2027年第一季度,届时其与Qwen 4.5、Qwen 5系列的配合效果,将成为观察阿里AI全栈能力的关键窗口。
该文观点仅代表作者本人,企服科学平台仅提供信息存储空间服务。