ARTICLE READING

步数与引导强度:调高调低分别发生什么

步数调高调低会怎样,有标准答案;但更该先确认的是你的工具到底有没有这两个旋钮。115 张图的记录里,这两项全是空的。

步数与引导强度:调高调低分别发生什么

先说结论:这两个参数调高调低会发生什么,有标准答案;但你的工具可能根本没给你这两个旋钮。顺序反了的话,你会花很多时间调一个不存在的开关。

这两个参数是干什么的

步数(steps)和引导强度(guidance scale,也叫 CFG)都来自扩散模型。

扩散模型的工作方式是:先给一张纯噪声图,然后一小步一小步地「去噪」,每一步都问一次「根据提示词,这里应该往哪个方向改一点」。步数就是去噪迭代多少次。引导强度则是每一步里「文本约束占多大权重」——把它调高,模型更听提示词的话;调低,模型更自由。

所以这两个旋钮都属于过程控制,调的是生成过程怎么走,跟画面内容本身无关。光线那一组参数是另一回事,真正影响光线的几个参数是什么 讲的是另一边。

调高调低分别会怎样

先说步数。

调低,去噪没走完就停。表现出来通常是:结构没立住、边缘发糊、细节像被水泡过。太低的时候甚至会出现明显的半成品感——主体轮廓在,但里面是糊的。

调高,收益是递减的。从 20 步加到 40 步,可能还有些变化;从 40 步加到 80 步,多数情况下你肉眼分不出来,但生成时间翻倍。这里没有「越高越好」,只有「过了某个点就没用了」。

找这个点的方法比记住某个数字有用:从低往高试,每一步都记下你看到的变化,直到再加步数画面不变——那个位置就是你这套提示词的拐点。它取决于模型、分辨率、提示词复杂度,别人给的数字对你没用。

再说引导强度。

调低,模型开始自由发挥。它仍然会画出一个合理的画面,但不一定是你要的那个——你写的元素可能缺失,或者位置、比例跟你说的不一样。

调高,模型会更严格执行你的字面要求,但代价通常有三样:画面整体对比变硬、暗部细节被压掉、饱和度和边缘容易过。调得太高时,常见的是颜色发闷发硬,过渡不自然。

这里有个容易搞混的点:引导强度高只代表更听话,不代表画得更好。如果你的提示词本身写得紧(元素多、约束多),高引导强度会把这些约束全压进画面,结果往往更僵。提示词写得松,才轮得到引导强度去收紧。

但我手上根本没有这两个旋钮

这是我要说的重点。

我为这个站做的一批图,一共 115 张(70 张东方题材 + 45 张高饱和 3D),每一张都留了生成记录。翻完这些记录你会发现一件事:

步数、引导强度、采样器、随机种子——这四个字段,115 张全部是空的。

不是我没记,是接口没给。70 张那批走的是中转接口,返回里根本没有这几个值;45 张那批用的是内置生成工具,工具的返回里同样没有。我在记录文件里写的是「不适用或待实际平台返回」和「工具未返回的模型版本及 Seed、Steps、CFG、采样器;未虚构」。

为什么没有?因为这两批用的都不是扩散模型。

步数和引导强度是扩散模型特有的机制——它从噪声出发、反复迭代去噪,才需要有「迭代几次」和「文本约束多强」这两个控制项。而这两批用的模型是另一种架构:逐 token 直接生成,不走迭代去噪这套流程。内部没有「第几步」这个概念,所以也没有步数可调。

引导强度同理——它的作用是调节文本约束在每一步去噪里的权重,没有「每一步」这个结构,这个旋钮自然无处安放。

采样器是同一类问题,采样器换一个,到底改变了什么 单独讲过一遍。

所以该怎么做

第一件事,先看你的工具。

打开参数面板,找两个输入框:一个叫 steps 或「步数」,一个叫 CFG、guidance scale 或「引导强度」。

  • 两个都有:你用的是扩散类模型。这两个旋钮值得调,按上面说的找拐点,别抄别人的数字。
  • 两个都没有:你用的是直接生成类。别去找教程里「30 步、CFG 7」的推荐值,那个旋钮不在你手上。精力应该放在提示词本身——先写清楚主体、视角、光线,再考虑加约束。
  • 只出现其中一个:以实际显示的为准,说明你的工具暴露了部分参数,没显示的那个就别管。

第二件事,把这四个字段记下来。

我在每张图的记录里都单独留了 parameters 段,即使全是空的也留着。原因很简单:空着的记录也是信息。等到某天需要复盘「当时为什么出成这样」,你能确定地说出不是参数问题——因为这几个参数当时就没有。如果当时随手填个好看的假值,三个月后你分不清哪个是真的。

这两批图的完整生成记录都在 创作解析 里,逐张可查。

一句话

调参数的收益,上限由「你的模型有没有这个参数」决定。先花一分钟确认这件事,比抄三天数字管用。

© 2026 AI视觉图谱渝ICP备2024034209号-1