今年 4 月,OpenAI 推出了 ChatGPT Images 2.0,对其图像生成模型进行了重大升级。在发布之初,ChatGPT Images 2.0 在各项指标上均大幅领先于市场上的其他图像生成工具。然而此后,微软凭借其自研的图像模型迅速缩小了与 OpenAI 的差距。
微软的首款 MAI-Image 模型于 2025 年 10 月在 Arena 文生图排行榜上首次亮相,位列第 9 名;2026 年 3 月,MAI-Image-2 攀升至第 3 名,同年 5 月发布的 MAI-Image-2.5 也稳居第 3。到了 8 月,MAI-Image-2.6 更是跃升至第 2 名,Elo 评分较前代提升了 79 分,紧追 OpenAI 的 GPT-Image-2。
据 OpenAI 披露,目前用户每周通过 ChatGPT Images 及其 GPT-Image API 模型生成的图片总量已突破 30 亿张。为了更好地服务庞大的用户群体,OpenAI 于今日正式宣布推出最新图像生成模型——ChatGPT Images 2.5。该模型在图像质量、编辑能力以及生成速度上均实现了显著提升。官方数据显示,与 Images 2.0 相比,Images 2.5 的图像生成延迟最高降低了 50%。
除了速度的大幅提升,Images 2.5 模型在渲染自然光照和丰富纹理方面表现更佳,并且能够更精准地保留参考图中人物主体的身份特征与外貌细节。同时,OpenAI 还优化了局部编辑功能,允许用户仅修改图像的特定区域,而保持画面其余部分基本不受影响。
另一项重大改进在于多轮编辑的稳定性。在用户持续精修图像的过程中,Images 2.5 能够更好地保留前序的编辑成果,避免了以往版本中容易出现的“牵一发而动全身”或画质随修改次数增加而衰减的问题。此外,新模型还支持更复杂的画面布局以及透明背景的生成。
在模型升级的同时,OpenAI 还同步推出了多项全新的图像创作工具:
Sketch(手绘草图):用户可以直接在 ChatGPT 界面中绘制粗略的草图,并将其一键转化为完整的图像。
Templates(模板库):提供海报、商品周边等常见内容格式的预设模板,为创作者提供便捷的起步框架。
Comment-based edits(图片评论编辑):用户可以直接在图片上添加批注,以请求对特定区域进行修改。
Prompt sharing(提示词分享):用户现在可以将自己生成图像的完整提示词分享给他人,方便复用与二次创作。
面向开发者群体,OpenAI 在 API 端首次推出了分层模型架构:
GPT-Image-2.5 Flare:主打高速、通用的图像生成,延迟降低 50%,适用于社交媒体内容、产品原型及大批量生成等高频场景。
GPT-Image-2.5 Sunburst:专为高精度创意工作流设计,以稍长的生成时间换取更精细的编辑控制,适用于品牌营销素材和精修产品图等高端场景。
目前,全新的 ChatGPT Images 2.5 模型已全面上线,覆盖网页端、桌面端及移动端,面向所有层级的 ChatGPT 用户、ChatGPT Work 以及 Codex 用户开放。