记录一下: AI 图片 prompt 越写越长,不如先把参考图的职责拆清楚

quanmengli 2026-07-20 18:02 1

最近给一个图像生成相关页面做测试,发现自己很容易陷进一个坑:图不对,就继续往 prompt 里加词。


比如一开始是:


modern editorial image, clean, premium, cinematic, minimal

然后发现不对,又开始补:


not too futuristic, not too dark, clean but not empty, premium but not luxury

写到最后,prompt 已经不像需求了,更像在跟模型讨价还价。


我测试的页面是这个: https://krea2.io/

主要是拿它试 reference image / image-to-image 这类控制方式,不是说这个站一定比别的强。


这次比较有用的经验是:文字适合描述“画什么”,参考图更适合描述“怎么看起来”。


我现在一般会先把参考图拆成几个职责:



  1. 一张只管光线,比如明亮、柔和、偏 editorial

  2. 一张只管构图,比如中间留白,适合放标题

  3. 一张只管色彩,比如蓝灰系或者低饱和

  4. 反例图也可以有一张,明确不要赛博霓虹/过度科幻


这样 review 的时候也更容易说清楚问题:



  • 这张构图对,但颜色不对

  • 这张颜色对,但主体太靠边,移动端会裁掉

  • 这张单看不错,但放到 landing page hero 里太吵


另一个坑是不要每次生成都同时改所有东西。prompt 、参考图、比例、风格强度一起改,下一张变好了也不知道是哪个变量起作用。


比较稳的流程:



  1. 先固定用途,比如 blog header / hero image / social card

  2. 第一批只看构图

  3. 第二批只调风格强度

  4. 第三批放进真实布局里看


尤其是最后一步,单独看图和放进页面完全不是一回事。很多图在 gallery 里挺好看,一放到标题下面就发现主体被挡、颜色抢 CTA 、移动端裁切很难受。


所以我现在觉得 AI 图片生成不太像“写一个完美 prompt”,更像做一个小型视觉实验。文字、参考图、比例、布局预览,每个变量分开测,比堆形容词靠谱很多。


有做设计/前端的朋友也这么用参考图吗?你们一般怎么避免每批图风格飘太远?

最新回复 (2)
  • lovekernel 07-20 18:27
    1
    做“参考图”素材会不会是一个赛道?做出能让模型快速识别的构图、风格强度等各类别的素材。
  • 383394544 07-20 18:42
    2
    AI 画图都是套模版排列组合,给参考图相当于给模型提供训练数据以外的模版。
* 帖子来源V2EX
返回