GPT-Image-2 保姆级使用教程:设计师和运营必须知道的 9 个工作流
4月21日,OpenAI发布了GPT-Image-2(也叫ChatGPT Images 2.0)。说实话,过去两年里,AI图像模型出了不少,但真正能打进专业工作流的,这是第一个。
它在LM Arena文生图榜单上拿下了1512分,领先第二名242分。这个差距有多大?大致相当于Nano Banana Pro和DALL-E之间的代差。
一、GPT-Image-2 是什么
GPT-Image-2是OpenAI在2026年4月21日发布的新一代原生多模态图像生成模型,内部代号"Spud"。它既是GPT-Image-1.5的全面升级版,也接过了DALL-E 3的接力棒。
核心升级点
1. 原生Thinking模式:生图前先规划,生图后自检
这是GPT-Image-2最核心的架构创新。它接入了OpenAI O系列推理模型,生成一张图需要走完整的八步流程:创建→打草稿→生成初稿→搭建场景→打磨细节→收尾→润色→微调。过程中还可以联网搜索、自检错误、迭代修正。这意味着——你让它生成一张财报信息图,它会先联网抓取最新数据,再画图,画完自己检查数字有没有错。这是所有Diffusion模型从架构上做不到的事。
2. 世界知识驱动
GPT-Image-2的训练数据明显偏向真实视觉素材——UI截图、店面招牌、真实界面布局。它生成的东西,符合真实产品的视觉规律。
3. 分镜的角色一致性
可以生成一组系列物料,比如一个IP形象的8张不同场景图,角色形象保持稳定。
4. 像素级局部编辑
修改指定区域时,其他部分几乎不会漂移。光照、透视、阴影的一致性都能完整保留。以前在PS里"手动抠图改细节"的动作,现在变成一句自然语言。
价格一览
| 分辨率 | Medium 质量 | High 质量 |
|---|---|---|
| 1536×1024(1.5K) | $0.04/张 | $0.16/张 |
| 2560×1440(2K) | $0.06/张 | $0.22/张 |
| 3840×2160(4K) | $0.10/张 | $0.40/张 |
二、GPT-Image-2 怎么使用
1. ChatGPT 免费版
所有ChatGPT用户(包括免费用户)从4月21日起都能用上GPT-Image-2。但免费用户只能用Instant Mode(即时模式),Thinking Mode是付费墙后的。额度方面,每24小时滚动窗口2~3张,高峰期压到3张封顶。
2. ChatGPT Plus / Pro(重度推荐)
- Plus(20美元/月):解锁Thinking Mode,每3小时50张左右,日均100+张
- Pro(200美元/月):几乎无限制,日均500+张
实操步骤很简单:
- 登录chatgpt.com,确认订阅状态
- 在对话框直接输入生图prompt或上传参考图
- 想触发Thinking Mode,在prompt末尾加上"think carefully before generating"或"请仔细思考再生成"
- Instant模式约3秒出图,Thinking模式约30-60秒
- 生成后可直接进入"编辑模式",用自然语言做局部修改
这里有一个很少人提的技巧:如果任务涉及实时数据(股价、汇率、新闻热点),直接说"先联网查最新数据再画图",会自动触发web search + 图像生成的组合链路。