sd图生图反推提示词怎么用?重绘幅度和词条取舍

sd图生图反推提示词怎么用?重绘幅度和词条取舍
sd图生图反推提示词配合不同重绘幅度的出图效果对照

开门见山讲结论:sd图生图反推提示词的价值完全取决于重绘幅度。幅度低于0.4时,反推出来的词条删不删几乎不影响出图,等于失效;0.5到0.7才是词条真正说了算的区间。下面这份六档实测记录,会告诉你每一档该怎么取舍词条。

sd图生图反推提示词的做法不复杂:把参考图丢进 img2img 页面,用 CLIP interrogate 按钮反推出一串英文词条,粘贴进正向提示词,再设好重绘幅度跑图。但大多数人卡在第二步之后——词条拿到了,不知道删哪些留哪些,改出来的图要么和原图一模一样,要么面目全非。我最近用一套固定参数,把0.3到0.8六个档位全部跑了一遍,结论写在下面。

sd图生图反推提示词怎么用:三步跑通

三步走:img2img 里丢图反推、按幅度粗筛词条、设重绘幅度出图,全程不超过三分钟。具体操作拆开讲。

第一步,WebUI 里切到 img2img 标签页,上传参考图,点 CLIP interrogate 那个深色按钮,几秒后正向提示词框里会多出一长串词条。第二步,先别急着跑图,把这串词粗筛一遍,质量词、风格词、内容词分开看。第三步,重绘幅度(Denoising strength)从0.6起步,先跑四张看效果,再决定往上调还是往下压。

我的测试环境说一下,方便你对号入座:RTX 3060,SD 1.5 的 anything-v4 模型,768×1024 的图,DPM++ 2M Karras 采样,25步,CFG 7,每档跑4张,六档共24张,前后花了大约40分钟,单张出图15秒左右。配置不算高。可后来在 SDXL 上抽查了几组,结论方向一致。

重绘幅度实测记录:0.4以下反推词基本失效

0.3档删光反推词重跑,出图和带词条的版本肉眼无差;0.5开始词条才真正参与构图,0.6到0.7是最值得花功夫取舍的区间。数据都在下表。

讲个翻车经历。上周三晚上帮朋友改一张海边婚礼插画,需求是把白天改成黄昏。我偷懒,直接用反推词原样跑0.35,四张图全都不动——天空还是白的,人物姿势一模一样,就是噪点多了点。说实话挺离谱的,提示词里明明写着 sunset 和 orange sky,画面毫无反应。把幅度提到0.6,同一串词立刻见效,第二张天空就压成了橘色。那次我才真正记住这个分水岭。

六档跑完的记录如下,每档4张取多数情况:

重绘幅度出图4张的多数结果反推词的实际作用
0.3和原图几乎一致,构图人物全没变删光词条重跑也没变化,基本失效
0.4构图稳住,花纹和背景细节开始漂只影响小细节,不参与构图
0.5服装纹样变了,姿势保留主干词开始起作用
0.6构图能被词条明显拉走最依赖取舍功力的一段
0.7只剩大致色块,内容大改词条主导画面
0.8结构散架,人物手崩了一半词条也救不回来

这张表我跑了两次才敢写,因为0.3档的结果太反直觉。原理不玄:幅度低,采样过程大部分被原图信息锚死,文本条件的发言权就小,你删不删词条,模型听到的都是原图。0.4以下想靠改词条改图,路子本身就不对,该调幅度或者用局部重绘。至于0.8,那已经不是词条的问题了。先救结构,再谈词条。

词条取舍:四类词的处理方式不同

内容词留、风格词逐个核对、质量词看幅度定去留、冗余词直接删——反推词只是底稿,不是终稿。展开讲。

CLIP 反推有个毛病,啰嗦且会认错。话说回来,它本来就是看图说话的模型,认错画风是常事。我那张婚礼图,它把水彩背景认成了 sketch,幸亏我多看了一眼。反推准确度和修补思路,之前写过一篇看图反写的实测(逆推提示词的准确度和修补方法),这里只讲取舍。

词条类型典型例子我的处理
内容词1girl, white dress, seaside0.5以上必留,是构图的骨架
风格词watercolor, anime coloring逐个核对,认错的比想象多
质量词masterpiece, best quality0.6以上留着提细节,低幅度删了无所谓
冗余词official art, very awa直接删,占token没贡献

反推词还缺两样东西,只能手写补:一是它看不出来、但你正想改的内容,比如黄昏光从哪边打过来;二是负面提示词,反推只管正向,负面清单得自己配,我常用的就是低质量基础词加上针对场景的崩坏词。

词条数量别贪多。删,比加管用。我的习惯是反推完先删到20个以内,跑一组,挑最接近预期的一张,把它的词条当下一轮底稿继续删。老实讲,反推词最大的用处是省掉从零写词的时间,而不是替你做判断。我个人觉得把它当七成底稿用,心态最顺。

回到开头那个结论:sd图生图反推提示词怎么用,一半看词条,一半看重绘幅度。0.4以下别指望词条发力,0.6前后大胆让反推词主导,超过0.8先解决结构问题。档位、参数、环境我全写进去了,照着跑一遍,十分钟就能摸到你自己模型的分水岭。

常见问题

反推出来的词条要原样全抄进提示词吗?

不建议。原样照抄的词里至少三成是冗余的,还有一两成可能判错。抄完先做减法,删到20个以内再跑第一轮,比全抄的出图干净得多。

重绘幅度低于0.4就一点用都没有吗?

低幅度本身有用,适合保结构、修细节,比如只改表情和花纹。没用的是反推词——这个区间删光词条重跑,图基本不变,想改内容请把幅度提到0.5以上。

反推词和手写词打架时听谁的?

听更具体、位置更靠前的那个。把想强调的手写词放在词条串前面,冲突的旧词直接删掉,靠堆权重硬压通常两边都画不好。

拿真人照片反推人脸有什么要注意的?

技术上行得通,但别用这套流程生成可辨认的真人脸去冒充他人,涉及肖像权和平台规则,用无具体指向的虚拟人物更稳妥。

什么样的图不适合用反推?

文字多的图和分辨率过低的图。反推会把图里的文字错认成乱码词条,低清图则推出一堆糊度词,两者都建议先手动写主干词。

延伸阅读