蚂蚁百灵开源Ming-Image-0.1-Design系列模型,UI设计专项评测位列开源第

在 Artificial Analysis 于 2026 年 9 月 18 日更新的 UI / UX Design 专项评测中,Ming-Image-0.1-Design 位列开源模型第 1,Elo 得分为 1082。

9月23日,蚂蚁百灵大模型正式开源Ming-Image-0.1-Design系列,包含两个参数量均为6B的模型:Ming-Image-0.1-Design和Ming-Image-0.1-Design-Layer。前者从文字需求生成UI、信息图、海报和完整视觉设计,后者将创意图或设计图拆分为可独立编辑的透明图层。蚂蚁百灵同时开源了Design Skill和PPT Skill,将模型能力延伸至前端页面与可编辑演示文稿。

据官方介绍,Ming-Image-0.1-Design重点增强了四项能力:支持8K长结构化提示词增强,将自然语言需求组织为文案、模块、布局和视觉风格;优化标题、按钮、卡片和多区域信息的文字渲染与版式稳定性;通过端到端生成一次性完成整体设计,统一配色、构图和素材风格;创建原生RGBA VAE,直接生成人物、商品、图标和装饰等透明背景素材。相比通过代码多次调用通用生图模型分别生成背景、插画和装饰,端到端生成拥有更完整的全局控制,能够减少素材之间色系冲突和画风不一致。

在Artificial Analysis于2026年9月18日更新的UI/UX Design专项评测中,Ming-Image-0.1-Design位列开源模型第1,Elo得分为1082。模型在UI/UX场景中的版式胜率达到67.4%,复杂构图达到67.0%,文字渲染达到66.7%。

官方同时披露了该系列模型的能力边界。Design目前最稳定的是排版和文字,但在处理复杂的人手动作、连续操作步骤,或需要精细阴影、反光效果的场景时,效果尚不够稳定。在Layer模型中,分层不存在唯一答案,有用户只需要背景、主体、文字三层,也有用户希望将每段文字和每个图标分别拆开。大量叠加光效、特殊透明材质和复杂遮挡,可能出现边缘残留或图层缺失。

为方便开发者快速体验,Ming-Image-0.1-Design已在OpenRouter开放为期两周的免费API调用。

该文观点仅代表作者本人,企服科学平台仅提供信息存储空间服务。

(0)
康奈尔大学研发可感知并调节环境温度的微型机器人
上一篇 1小时前
优必选U1交付预期从万台缩水至1500台,人形机器人商业化面临制造门槛
下一篇 1小时前

相关推荐

发表回复

登录后才能评论
分享本页
返回顶部