微软发布MAI-Image-2.6-Flash图像生成模型 称生图速度为GPT Image 2两倍

微软建议,对延迟、吞吐量和成本更敏感的任务使用MAI-Image-2.6-Flash。

微软于9月4日发布博文,宣布推出自研图像生成模型MAI-Image-2.6-Flash,并通过Microsoft Foundry平台开放公开预览。该模型是微软MAI系列图像生成模型的最新成员,定位为速度优化版本,与旗舰版MAI-Image-2.6共享核心能力,但在生成速度和推理成本上做了针对性优化。

定价方面,MAI-Image-2.6-Flash的API按每百万Token计费,文字输入价格为1.75美元,图片输入价格为2.50美元,图片输出价格为19美元。相比之下,旗舰版MAI-Image-2.6的对应价格分别为5美元、8美元和38美元。Flash版本的各项定价均显著低于旗舰版,其中图片输出成本降幅达到50%。

功能层面,MAI-Image-2.6-Flash与MAI-Image-2.6共享文生图(text-to-image)和图生图/图像编辑(image-to-image editing)的核心能力,包括对象移除与替换、局部重绘、属性修改、文字更新等操作。微软表示,尽管Flash版本重点优化生成速度和成本,但其仍保留了MAI-Image-2.6的核心生成与编辑能力,模型既支持从文本直接生成图像,也支持对现有图像进行编辑修改。

在应用场景划分上,微软给出了明确的建议:对最终生产素材、复杂编辑、商业设计以及高图像质量和文字渲染要求较高的任务,建议使用MAI-Image-2.6旗舰版;而对延迟、吞吐量和成本更敏感的任务,则建议使用MAI-Image-2.6-Flash版本。这一产品分层策略与微软在语言模型领域的思路一致,通过提供不同性能与价格档位的模型,覆盖更多元的客户需求。

微软AI负责人穆斯塔法·苏莱曼(Mustafa Suleyman)在社交平台上表示,与目前业界最强的GPT Image 2(微软官方博文标注为GPT-Image-2-Medium)相比,MAI-Image-2.6-Flash的生图速度是其2倍,GPU效率提高了72%。这一数据直接指向了Flash版本的核心竞争力:在保证图像质量的前提下,大幅提升推理效率并降低算力消耗。

此次发布距离微软推出MAI-Image-2.6旗舰版仅三周时间。此前,MAI-Image-2.6在Arena文生图模型排行榜上跃升至第二位,显示出微软自研图像生成模型在技术能力上的快速提升。Flash版本的推出,意味着微软正在加速构建覆盖不同性能层级的图像生成模型产品矩阵,以应对企业客户在成本、速度和效果之间的多样化权衡。

从行业视角看,图像生成模型的竞争正在从单一的质量比拼,转向质量、速度与成本的多维竞争。OpenAI的GPT Image系列、谷歌的Imagen系列以及Anthropic等厂商均在推进各自的产品迭代。微软选择在旗舰版发布后短时间内推出Flash版本,并通过Microsoft Foundry平台开放预览,意在为企业开发者提供更灵活的模型选择空间,降低图像生成能力在生产环境中的落地门槛。

随着MAI-Image-2.6-Flash进入公开预览,微软的图像生成模型产品线已形成旗舰版与Flash版的双档结构。后续该模型能否在更多性能基准上获得验证,以及是否会进一步扩展至更多Azure区域,值得持续关注。

该文观点仅代表作者本人,企服科学平台仅提供信息存储空间服务。

(0)
英伟达发布616.86热修复驱动 解决浏览器闪屏与远程桌面黑屏问?
上一篇 2小时前
特斯拉Cybercab在美国投入Robotaxi运营 博主MKBHD赌约暂告安全
下一篇 1小时前

相关推荐

发表回复

登录后才能评论
分享本页
返回顶部