你无需特殊语法、权重或堆砌关键词,就能获得出色的效果 GPT Image 2.5。模型真正看重的,是把你想要呈现的画面用清晰、连贯的顺序描述出来。
本指南将带你了解如何构建一条 prompt、如何描述图像中最关键的要素,以及如何措辞才能让模型只改动那个精确的部分,而其余部分保持原样。
开始前的一点提示:在 OpenArt 中,分辨率、宽高比和每个 prompt 生成的图像数量由 prompt 框下方的控件设置。这些设置会覆盖你在 prompt 中输入的相关内容,所以你完全可以省略它们,把文字都用在描述图像本身上。
安排好 prompt 顺序并写得具体
一个可靠的顺序是 主体、构图、风格、限制。按这个顺序进行能让重要信息排在前面,也让 prompt 之后更易于编辑。
以下是同一个想法先松散地写、再有序地写的对比:
模糊写法:"一张咖啡杯的好看照片,温馨氛围,专业感"
有序版本:"一只白色陶瓷咖啡杯放在亚麻桌布上。低角度拍摄,杯子居中,画面上部三分之一留空。照片级真实感,左侧窗户透入柔和的晨光,浅景深。无文字、无标志。"
第二条 prompt 给了模型一个主体、一种取景、一种风格和一个限制。这些都是你可以在下一轮里微调的,不必重写整段内容。
这就是那条有序 prompt 在 GPT Image 2.5 Flare 中生成的图像:

描述这张图的用途
点明用途的帮助比大多数人想象的都大。"用作落地页头图的产品照"和"用作 Instagram 帖子的平铺图"描述的是同一个杯子,却会产出不同的图像。
用几个字加上使用场景:书籍封面、缩略图、包装样机、贴纸、幻灯片背景。模型会据此对取景和留白做出合理的选择。
用具体的视觉细节替换氛围词
像温馨、史诗、氛围感和高级这样的词,单独用时对模型几乎没什么信息量。一旦为它们挂上可见的具体内容,效果就好了。
对于开阔或富有氛围感的场景,直接描述比例、氛围和色彩。"壮阔的山景"应改为"一座花岗岩山峰占据画面右半部分,低垂的云层横贯下方山谷,日出前的冷蓝色光线。"这样的版本给模型一幅可以构建的画面,而不是一种需要猜测的感觉。
人物同理。描述可见的身体范围有多少、主体在画面中占多大、视线看向哪里、双手在做什么等等。
明确说明光线、材质和色彩
在一张成品图中,这三点承担了大部分的视觉分量。
直接点名材质:拉丝铝、哑光纸板、湿沥青、原色亚麻。点明光线的来源和方向:左侧的一扇窗、阴天的天空、主体后方的一盏暖灯。点明你想要的颜色,也点明你想排除的颜色。
如果你想要一张照片,就直接说。像照片级真实感、真实照片、胶片颗粒或浅景深这样的词能引导整体观感。把它们当作外观提示,因为它们描述的是图像应有的样子,而非真有相机拍下了它。
把确切的字句放进引号里
GPT Image 2.5 在图像中渲染文字比早期版本更准确,而引号正是你告诉模型哪些文字需要原样呈现的方式。
这样写:'一张海报,顶部横排以粗体压缩字体写着标题"Open Late",底部以小号字体写着"Thursday to Sunday"。无其他文字。'
三个习惯能让文字更常正确呈现。逐字母拼出不常见的单词和品牌名。描述每一行文字的位置,以及大致的字体样式。要求不添加多余文字,因为多余的词是文字密集图像中最常见的问题。然后在发布前先读一遍输出结果,用后续编辑修正任何拼写错误。
为每张参考图明确赋予用途
当你上传多张参考图时,告诉模型每张图的用途。否则,它会将它们混合在一起。
直白地分配角色:"第一张图用作产品。第二张图用作背景环境。第三张图只用作配色。"然后说明它们应如何组合、哪个元素移到哪里。"把第一张图里的产品放到第二张图的桌子上,光线方向要与第二张图一致。"
编辑时每次只改动一处
编辑最好拆成一连串单一决策来完成。每次只要求改动一处,看看结果,再进行下一步。
以改动本身作为指令的开头:"仅将背景改为纯灰色的影棚墙面。"简短、具体,且只针对一件事。五次清晰的对话比一个塞进五项要求的 prompt 更能奏效。
列出编辑中应保持不变的内容
正是这个习惯区分了利落的编辑和推倒重来。在描述改动的同时,也点明你想保留什么。
一条完整的编辑 prompt 是这样的:"只把背景换成纯灰色影棚墙面。产品的形状、标签文字、颜色和反光都保持原样不变。保留原有的光线方向以及产品下方的阴影。"
每一轮都重申这些约束。在一场漫长的编辑过程中,细节可能会走样,而重复这份清单正是让你已认可的版本保持不变的关键。像"和之前一样的风格"这类说法能给模型有用的上下文,所以要把它们和你的具体要求搭配使用,而不是用来替代它们。
描述你不希望出现在图像中的内容
一份简短的排除清单是最省成本的画质提升方式之一。这些常见项值得随手备着:
- 不要多余文字
- 无水印或签名
- 不要标志
- 无过度修饰
- 除非必要,否则不用渐变
排除项对透明背景和产品抠图最为关键,这类图里哪怕一道多余的阴影或一层淡淡的背景都会前功尽弃。请要求干净的边缘,主体后方不留任何东西。
长而复杂的 prompt 请使用带标签的分段
当一条 prompt 超过几句话时,就把它拆成带标签的分行。模型读起来毫无问题,而你也得到一条真正好维护的 prompt。我们来看个例子:
场景:阳光普照的青草山坡草甸,连绵起伏的绿色山丘,蓝天。画面中景有一辆改造成果汁吧的复古薄荷绿大篷车,车上支着奶油色与鼠尾草绿相间的条纹遮阳篷,窗口摆满了五彩缤纷的鲜榨果汁瓶、柑橘和野花。两名店员在柜台前招待。草坪上摆着奶油色小酒馆桌和鼠尾草绿折叠椅。
主体:前景:一位年轻女子,长长的波浪状铜红色头发,脸上有雀斑,头顶戴着黄色猫眼太阳镜,珊瑚色衬衫裙外搭奶油色百褶裙。她倚在桌边,用红白条纹吸管啜饮粉色果汁,直视镜头。她身旁有一瓶插着柠檬片的柠檬水和一个淡黄色手拿包。背景:四位身着柔和夏装的女子或坐或站,每人手里都拿着一杯果汁。
艺术风格:高端时尚杂志摄影,复古 1950 年代美式风格,兼具现代精致感。50mm 镜头,前景清晰,背景柔和虚化。明亮的正午阳光,珊瑚色、奶油黄、薄荷绿、腮红粉、米白的柔和色调。宽幅电影感构图。
限制:不要冰淇淋、奶昔、鲜奶油、蛋筒或甜品玻璃器皿。不要冰淇淋车或招牌。不要文字或标志。不要建筑、汽车或手机。手部与人体解剖自然。
GPT Image 2.5 Sunburst 生成的结果:

下次需要变体时,你只需改动一行。
选择你的模式,然后用同一条 prompt 测试
Flare 和 Sunburst 对相同的 prompt 习惯都有响应,所以切换时上述内容一概不变。
在探索创意、编写变体和制作日常素材时使用 Flare。当图像需要经得起近距离审视,或编辑需要精细控制哪些部分保持不变时,改用 Sunburst。
在两者之间抉择时,用相同的 prompt、相同的参考图和相同的设置分别跑一遍,先对比两个结果,再开始调整其他任何东西。
需要避免的常见错误
- 过度依赖特殊语法、符号或权重。清晰的句子效果更好,也更容易编辑。
- 在一个聚焦的请求中加入无关指令,会让模型朝两个方向拉扯。
- 在编辑过程中途遗漏了你的保留清单。
- 使用没有具体视觉细节的模糊描述词。
- 指望更高的质量设置来弥补模糊的 prompt。真正决定结果的是描述本身。
综合运用
描述主体,为它构图,说明风格,并设定限制。编辑时,只要求一处改动并列出应保持不变的内容。把分辨率等设置留给 prompt 框旁的控件,把你的文字都用在描述图像上。
从一条你能读给自己听、并在脑海里想象出来的 prompt 开始。如果你能把它画面化,模型就很有机会把它做对。
在 OpenArt 上,用 GPT Image 2.5 把你最天马行空的创意变为现实 AI 图像生成器.