OpenAI 正式发布 GPT-Images-2.5,在图像生成领域掀起新一轮技术革新。这款新模型不仅将生成延迟缩短至多一半,还显著提升了编辑精度,并首次引入 Sketch 手绘输入功能,为开发者提供快慢两档模型选择,进一步拓展了 AI 图像生成的应用边界。
据官方披露,GPT-Images-2.5 已向 ChatGPT、ChatGPT Work 和 Codex 的全线用户开放,包括免费版用户。数据显示,该系统每周生成图片量达 30 亿张,日均处理约 4.3 亿张图片。此次升级带来的体验提升,远超常规功能迭代范畴。
在核心性能方面,新模型实现双重突破。生成速度较前代提升最高 50%,同时优化了照片与纹理的渲染质量,人物主体还原度显著增强。编辑功能迎来关键改进,通过精准区域修改技术,用户可指定编辑范围而不影响画面其他元素,在复杂背景和多主体场景下表现尤为稳定。多轮编辑一致性测试显示,反复修改同一张图片时,前序编辑成果与画质均能完整保留。
产品层面推出四大创新功能。Sketch 手绘输入允许用户通过 @Sketch 命令开启绘图面板,以草图配合文字描述生成成品图。官方演示案例包括将房间布局草图转化为室内设计渲染图,以及将人物轮廓转化为专业插画。模板库覆盖海报、商品图等高频场景,用户填充信息后即可按预设结构生成图片。Prompt 分享功能则支持用户导出完整生成指令,他人替换照片和细节后可生成同风格作品,目前社交平台已流行"80 年代复古肖像"等共享指令。
针对开发者需求,API 端首次推出分层模型体系。GPT-Image-2.5 Flare 主打高速批量生成,适用于社交内容、产品体验图等高频场景,实测出图速度达前代 2-4 倍,透明背景生成能力显著提升。GPT-Image-2.5 Sunburst 则定位高端创意工作流,通过延长生成时间换取更精细的编辑控制,主要面向品牌营销素材和精修产品图等场景。Adobe 已确认在 Firefly 中接入该模型,其产品总监 Matt Chotin 特别指出,新版本在多轮精修后仍能保持图片清晰度和真实感。
此次升级标志着图像模型迭代进入新阶段。从 2024 年底的 GPT-Image-1.5 到如今的 2.5 版本,OpenAI 保持每年两次重大更新的节奏,技术演进速度已与语言模型看齐。通过架构优化实现速度与精度的同步提升,再配合分层产品策略满足差异化需求,这种发展路径正在重塑 AI 图像生成领域的竞争格局。








