在2026年云栖大会现场,阿里巴巴公布了大模型研发的一系列最新进展。基于新一代架构的Qwen4已进入训练阶段,未来Qwen4.5、Qwen5等版本将扩展至5-10T参数规模。与此同时,大模型递归自我改进(RSI)已初步进入模型训练、推理及芯模协同等环节。
阿里系统展示了千问大模型在自我进化方向上的探索成果。在模型自我训练方面,Qwen3.8-Max通过自主搭建训练流程、构造训练数据,并自主设计实验、定位缺陷,在人类完全零参与的情况下持续迭代超过1个月,完成33轮有效迭代。基于RSI、后训练等系列技术联合优化,Qwen3.8-Max新版本在Artificial Analysis上的得分从40提升至45分,与Claude、GPT最强模型同处第一阵营,领先于GLM5.3、Kimi-K3等国产模型。
在推理优化环节,Qwen3.8-Max在从未见过的平头哥新款GPU上,自主适配并优化了下代架构Qwen3.8-Flash新模型的推理框架,实现单实例推理吞吐量提升96%。在芯片模型协同设计方面,Qwen3.8-Max仅基于一份真实的总线模块规范,自主展开前端、验证、后端的全链路自迭代,在自主运行超60小时、调用EDA工具超万次后,完成了减少42%面积的物理实现优化。
多模态模型矩阵也在同步更新。阿里全新的下一代视频生成模型将于11月发布,朝着更长、更可控、更完整、更智能的方向演进。据现场介绍,新模型在更长的时间跨度内仍能保持一致性,创作者可精准掌控人物、场景与镜头;同时,模型将具备导演级的创作思维,从生成单个镜头迈向理解完整叙事。此外,阿里的语音模型、图像模型、世界模型、音乐模型以及全模态模型均在当天或近期推出新版本。
阿里巴巴ATH技术副总裁、淘天集团首席科学家郑波在云栖大会现场提到,三年内会出现一个原生全模态统一模型,体验将不再受限于模态的边界。
在终端侧,阿里大模型加速走向落地。AI手机全栈解决方案Qwen Intelligence正式发布,专为手机场景深度优化,为合作伙伴提供基于千问大模型的Agent技术平台,使手机能够更可靠地完成跨应用的复杂任务。
从此次云栖大会披露的信息来看,阿里在大模型领域的布局正从单一模型能力提升转向训练、推理、芯片协同与终端落地的全链条推进。RSI技术的初步应用意味着模型迭代效率可能迎来结构性变化,而5-10T参数规模的规划则指向更高密度的能力上限。随着视频生成模型和全模态统一模型的推进,大模型在内容创作与人机交互层面的边界将进一步扩展。
该文观点仅代表作者本人,企服科学平台仅提供信息存储空间服务。