ARTICLE READING

为什么同一个提示词,两次结果不一样

同一段提示词跑两次结果不同,这件事在一手记录里有四个层级的证据。从连尺寸都不固定,到只有你写死的行才能复现。

同一段提示词跑两次,结果不一样,这件事在记录里有四个层级的证据。从最粗的那一层说起。

第一层:连输出尺寸都不固定

70 张那批,`requestedSize` 全部填的是 2048×1152。实际返回的是 1672×941(42 张)和 1672×940(28 张)。

同一个请求值,出来两种尺寸,高度差一个像素。记录里专门写了一句"记录实际尺寸,不冒充 2K"。

这一层不涉及构图、不涉及风格,它只说明一件事:接口给你的东西本来就不会逐像素一致。

第二层:背景可能整个没生成

45 件里有一件的偏差记录是这么写的:初次生成错误输出透明背景,已用一次定向编辑补全鲜绿棚景;最终液冠薄面较浅,厚液池偏浓紫。

第一次出来的那张,背景是空的。不是背景不好看,是没有。主体画对了,背景没画。

所以"两次结果不一样"里最极端的情况,不是构图偏了,是有一项直接缺失。

第三层:偏的方向每次还不一样

45 件那批 45/45 全部填了偏差记录,共 53 条。同样是机位没按计划,抽两条看:

  • CQ-002:画面较计划更接近正面平视,顶部留白略少
  • CQ-007:机位比计划中的高位斜俯更低,采用接近侧前方的三分之二视角,主体占幅较大

一条偏向了更平,一条偏向了更低更近。同一批、同一个字段、同一个"偏",方向并不统一。

再抽两条,偏的还不只是机位:

  • CQ-001:策划中的单次绞转变为多段连续蛇形弯折,主体更接近竖向上升
  • CQ-003:软垫及橙色气囊左端局部出画,属于极近景裁切,未表现完整物体

一条是动作结构变了,一条是主体直接被裁掉一部分。53 条记录里的偏,类型各不相同。

这说明差异不是那种可以用一个范围圈住的偏移,它是各方向的。

差异不是后期造成的

有一种常见猜测是:两次不一样,会不会是后面处理得不一样。这批记录可以把它排除掉。

45 件的交付核验里写着:全程没有裁切、没有生成式重绘,两项分别记作 `no_crop` 为真、`generative_redraw` 为假;原图与交付图之间的最大平均像素差是 2.75,满值 255。

后期这一路几乎不动像素。差异发生在更早的地方,不在处理环节。想靠后期把两次结果调成一样,方向就错了。

第四层:能复现的,只有你写死的那几行

回头看 70 张那批的字段统计,答案就在里面。

`Style/medium`、`Constraints`、`Use case`、负面清单,这四项各只有 1 种值,70 张一字不差。`Lighting/mood` 有 69 种,`Composition/framing` 有 65 种。

那四项是每次都会一样的部分,后面两项是每次都不同的部分。

你写死的行越具体,两次结果的重合面就越大;写得越模糊,差异就越大。像"电影感"这种词,写不写差别不大,因为它在两次里都可以被解释成不同的东西;而"左侧留白约占画宽四分之一"这种写法,留给模型的余地就小得多。这一点和 权重与顺序:同一句话换个位置结果就变 讲的是同一层机制。

《门后星湖》那张记录写的是"旧木门打开后不是房间,而是一片星光湖面",叙事线索补了一句"门外仍是普通老屋地面"。

同一扇门,门外和门内是两个世界。同一个提示词跑两次,差不多也是这个意思——你给的是一扇门,模型决定推开门之后看到什么。

该怎么改

不要追求两次一样,追求差异落在你能接受的范围里。

判断标准很直接:这次和上次的不同,是不是落在你写死的那些字段之外。落在外面,正常,不用管;落在里面,说明那一行写得太松,把它写具体。

45 件那批的做法可以照搬:每一件都记一条偏差,45/45 全填。下一轮开工前先看偏差表,再动提示词。有了这张表,你至少知道"不一样"是往哪个方向不一样的。同一批里只有 4 件返工过,全部落在背景上——迭代修改:不重写整段的改法 里记了这 4 次改稿的写法。

还有一件可以提前做的事:把"偏了之后怎么办"也定成固定动作。

70 张那批的 `keyAdjustments` 里挂着三条,其中一条是:生成后如主体不清晰,增强视觉锚点但不要加入文字。它的用处是——结果偏了之后该做什么,是提前写好的,不靠临场想。你那批图也可以先定两三条这样的兜底动作,比每次现场判断稳得多。

相关画册:梦境超现实|同栏目文章:效果教程|参数不是越多越好

© 2026 AI视觉图谱渝ICP备2024034209号-1
同一个提示词两次结果不一样:四个层级的真实原因 - AI视觉图谱