OpenAI于9月9日正式发布ChatGPT Images 2.5图像生成模型。该模型在保持细节锐度、自然光照和纹理丰富度提升的同时,将图像生成延迟最多降低50%,并新增Sketch草图参考、模板库及图片内评论标注等实用功能,是该公司当前最先进的图像生成模型。
相较于2026年4月发布的Images 2模型,Images 2.5在性能提升上重点聚焦于生成速度。OpenAI表示,在图像质量未受影响的前提下,通过优化推理路径和模型架构,将端到端生成延迟压缩至原来的50%。这一改进对于需要高频生成图像的企业级应用场景,如社交媒体内容生产、电商产品图渲染和创意快速原型验证,具有直接的效率价值。
功能层面,ChatGPT Images 2.5引入了Sketch功能。用户可通过输入“@Sketch”调用该功能,在对话界面中直接绘制草图,再补充风格和细节描述,模型即可将草图转化为完整图像。该功能降低了图像创作的门槛,使不具备专业设计能力的用户也能通过粗略线条获取成品级视觉素材。产品同时新增了海报、商品等常见创作格式的模板库,进一步简化了从构思到成图的流程。
图片内评论功能是本次更新的另一项亮点。用户可以直接在图像上标注位置,并发出“删除此区域”或“将此改为蓝色”等指令,模型仅对指定区域进行修改,其余部分保持不变。多轮编辑过程中,模型能够更好地保持图像的一致性和质量,避免因反复修改导致的细节退化。此外,用户在分享图像时可附带原始提示词,便于团队协作时的上下文追溯。
在API服务层面,OpenAI提供了两款针对不同应用场景的模型。GPT-Image-2.5 Flare面向多数API图像生成应用,适用于创作者内容、社交内容、产品体验、视觉搜索、快速原型和高批量生成等场景。GPT-Image-2.5 Sunburst则面向对编辑控制要求更高的工作流,OpenAI建议将其用于成品级营销素材和精修产品图等场景,但该模型的生成时间相对更长。
API支持多种分辨率输出,包括1024×1024、2048×2048以及3840×2160(4K横向)等规格,单边最长不超过3840像素,总像素数介于655,360至8,294,400之间。定价方面,两款模型的收费标准保持一致:图像模态输入价格为每百万像素8.00美元,缓存输入为2.00美元,输出为30.00美元;文本模态输入价格为每百万Token 5.00美元,缓存输入为1.25美元。
安全和合规方面,Images 2.5延续了OpenAI现有的安全机制,对提示词和生成图像均实施内容检查以防止有害输出。所有生成图像均嵌入C2PA元数据和隐形水印,便于识别由OpenAI工具生成的图像,以打击未授权复用或深度伪造行为。
此次模型更新延续了OpenAI在生成式AI领域的产品节奏。随着图像生成在企业营销、产品设计和内容创作中的渗透率持续提升,延迟降低和精细化编辑能力将成为模型竞争力的关键维度。Images 2.5的发布,也意味着多模态生成工具正从单纯的创意辅助向企业级生产流程中的标准化组件演进。
该文观点仅代表作者本人,企服科学平台仅提供信息存储空间服务。