OpenAI 更新了图像提示词指南,我把示例和使用要点整理进了开源仓库

VulcanEon 2026-09-13 17:47 1

最近看了 OpenAI 更新后的图像提示词指南,里面有 Flare / Sunburst 的示例对照,也补充了选模型、连续编辑和结果检查的说明。我顺手把这些内容整理进了之前做的开源 Prompt 合集,单独开了一个官方教程板块。


先交代一下:我是 gptimage25.ai 的维护者,这个仓库也是我们维护的。网站是商业项目,GitHub 合集可以独立使用,不需要注册网站,也没有限定必须在哪个平台运行。


仓库:insane-gpt-image-2.5-prompts


原文:OpenAI 图像提示词指南


我觉得这版指南最值得看的,是它把“想生成什么”和“怎么判断生成对了”放到了一起。


比如写人像,要交代取景、动作、光线和皮肤质感;做广告,要明确文字内容、位置和出现次数;做图表,要给出真实数据和关系;改图时,要同时说明修改项和保留项。这些要求更容易对应到具体的检查动作。


其中几个点,对实际使用挺有帮助。


第一,选模型可以从自己的合格标准出发。


指南把 Flare 定位为速度优先,Sunburst 定位为质量优先。已有 GPT Image 2 工作流如果质量够用,可以先用相同输入测试 Flare ;复杂任务原来做不好,则先测试 Sunburst 能不能满足要求,再看 Flare 是否也能做到。


比较时先固定提示词、参考图、尺寸和质量设置。否则一边换模型一边改 Prompt ,很难知道结果改善来自哪里。官方也提醒,相同质量档位不代表不同模型的效果或耗时相同。


第二,编辑任务需要把参考图和保留条件说清楚。


教程里有换衣服、移除手里的花、替换房间里的椅子、把另一张图的狗放进场景等例子。它们都有明确的修改对象,也有需要保留的人物、背景、光线或构图。


连续编辑同样如此:先做好一张广告牌,再把上一轮输出传回去,只改成下雪的冬日傍晚。绘本角色则先建立形象,再用角色图继续下一个场景。


我在整理时特意标出了这些输入关系。只复制第二轮的那一句话、却没有传入上一轮图片,实际已经变成另一个任务了。


第三,图像好看只是验收的一部分。


官方示例覆盖了纪实肖像、咖啡机流程图、带文字的广告、透明 Logo 、历史场景、四格漫画、App 界面、细胞呼吸教学图、融资幻灯片,以及翻译、抠图、草图转写实、人物合成、连续故事和包装设计。


这些任务的检查方式差别很大:广告要查拼写;流程图要查箭头与部件关系;换装要查人物有没有变;透明背景要看文件实际的 alpha 通道,画出来的棋盘格不能算透明。


融资幻灯片那个例子还有个明确说明:里面的市场数字和引用是虚构的设计输入。拿来学习排版可以,用进真实材料前要换成核验过的数据。科学图解也需要额外核对事实。


第四,参数和示例代码要单独看。


指南把模型、质量、尺寸、透明背景等请求参数与画面描述分开讲。对需要保留透明度、准确尺寸的任务,这部分和 Prompt 同样重要。


另外,我核对时发现,页末 Python / Ruby 完整示例仍然固定使用 gpt-image-2。虽然它放在 2.5 标签页里,复制运行也不会自动变成调用 2.5 。这个细节我在仓库里单独写了说明。


这次仓库已经更新并推送了:



  • 中英文 README 新增官方教程入口。

  • 教程导读整理了选模、参数、提示词原则、迁移和结果检查。

  • 按当前页面逐条收录 24 个独立提示词步骤,以及 54 张官方输出对照图。

  • 每步保留官方原始提示词入口、参考图、参数和前后依赖,并补充双语学习改写与检查点。


数量说明一下:我最初看到的说法是 23 个示例,但按 9 月 13 日页面里“有独立提示词的小节”核对,得到的是 24 步,其中包括广告牌两轮和角色故事两轮。Logo 的多组变体没有重复算成多条 Prompt 。


官方教程与原来的 30 个社区图文案例、20 条编辑指令分开收纳。官方图文也与我们编写的学习改写分开标注:原始 Prompt 去官方页面复制,仓库代码块是教学改写,官方配图不代表我们运行这些改写后的结果。目前没有逐条进行独立生图复现。


仓库原创内容继续使用 MIT ;官方及其他第三方图片、原文不包含在这个授权里。


如果习惯网页浏览,也可以从我们整理的 图像提示词案例库 找创作方向,再到 文生图工作区 替换成自己的主体和文案做实验。用其他工具同样可以,建议先固定一组输入和检查标准,再比较模型或修改提示词。


想问问大家:做图像生成或编辑时,你们更常遇到的是第一张图不满意,还是后续修改把本来满意的细节改坏了?后者有没有比较稳定的处理办法?

最新回复 (0)
    没有回复
* 帖子来源V2EX
返回