在使用Stable Diffusion这类AI绘图工具时,采样步数(Sampling Steps)是最常被新手忽视、又最容易走极端的参数之一。有人默认20步觉得不够,直接拉到100步等半天;有人图省事只给10步,结果画面到处是噪点和模糊结构。其实采样步数并不是越多越好,也不是越少越快越好,它背后有一套清晰的原理和经验规律可循。

采样步数到底是什么?先搞懂原理再谈设置
Stable Diffusion本质上是一个扩散模型,它的工作过程可以理解为“去噪”。生成图片时,模型先拿到一张充满随机噪声的图,然后通过一步步的计算,逐渐把噪声剥离,让画面从混沌中浮现出来。采样步数就是控制这个去噪过程要执行多少轮计算的参数。
可以把这个过程类比成雕塑:步数相当于雕刻刀落刀的次数。刀数太少,雕像只有大致轮廓,细节全无;刀数合适,轮廓和细节都能呈现;但如果继续增加刀数,雕像不会变得更精致,反而可能在已经完成的作品上反复修修补补,浪费时间甚至造成损伤。
实际测试中你会发现一个普遍规律:大部分采样器在20到35步之间就已经收敛,也就是说画面质量基本达到稳定。超过这个区间后,再增加步数带来的变化极其细微,肉眼几乎看不出区别,但生成时间却是线性增加的。一张1024x1024的图,20步可能只要十几秒,80步就要一分钟以上,产出效率差距非常明显。
不同采样器的最佳步数范围差异很大
采样步数不是孤立起作用的,它和采样器类型深度绑定。不同采样器的收敛速度差别巨大,用同样的步数跑不同采样器,效果可能天差地别。
以常见采样器为例:Euler和Euler a属于收敛较快的类型,通常20到30步就能出效果,步数再高提升很小;DPM++ 2M这类经典采样器在25到35步区间表现稳定,是很多工作流的首选;而像UniPC、DPM++ 3M Sde这类新一些的采样器,甚至15到20步就能达到不错的质量,特别适合追求出图速度的场景。
还有一个特殊情况值得注意:Euler a这类祖先采样器带有随机性,理论上步数越高画面变化越大,不会完全收敛。如果你用它跑50步以上,可能出现画面细节“变异”的情况,人物五官反而变得奇怪。所以针对这类采样器,控制在30步以内是更稳妥的做法。
按实际场景选择步数:给一组可直接照抄的数值
日常出图找灵感和测试提示词时,速度优先,建议15到20步搭配DPM++ SDE Karras或UniPC,几十秒就能看到结果,方便快速迭代提示词。这个阶段画面不需要完美,只需要方向正确。
正式出图或放大重绘时,建议25到35步,配合Hires.fix高清修复时,重绘幅度在0.4到0.6之间的话,放大阶段的步数20到25步通常够用。这个区间是质量和速度性价比最高的档位,也是社区大量实践验证过的甜点区。
特殊情况下可以适当拉高:比如画面元素特别复杂、提示词很长很详细,或者使用了对步数敏感的采样器(如Heun),可以尝试40到50步。但超过60步几乎没有任何必要,纯粹是在消耗显卡时间和电费。
判断步数是否合适的实用方法
与其记固定数值,不如掌握判断方法。最直接的做法是固定一个种子,其他参数不变,只改步数做对比测试。比如分别跑15步、25步、35步,把三张图放在一起看。如果25步和35步的画面肉眼已经分不出差别,那就用25步,省下的时间可以多抽几张卡挑选构图。
另外要留意几个“步数不足”的信号:画面整体发灰有雾感、暗部出现明显噪点、细节纹理模糊、边缘有毛糙感。出现这些情况先加5到10步试试,而不是急着大改提示词。反过来,如果画面出现颜色过饱和、人物皮肤蜡黄发腻,可以试着降低步数,有时候反而更干净。
最后提醒一点,批量生产图片时步数的影响会被放大。假设你一次要出200张图筛选拿去训练LoRA,每张图多花20步,总时间可能多出一个小时以上。养成“够用就好”的步数习惯,长期积累下来的效率提升非常可观。
总结一下核心结论:绝大多数场景下,20到35步覆盖了几乎所有需求;追求速度可以下探到15步左右,复杂画面最多到50步封顶。固定种子做对比测试,找到你自己模型和采样器的收敛点,才是真正的最佳平衡点。
采样步数Stable DiffusionAI绘图修改时间:2026-09-04 05:36:30