sd角色提示词怎么写?固定脸型的角色一致性
直接给结果:固定脸型不靠堆形容词,靠三层锁——五官细节词置顶加权重、发型词整段复用、种子锁死后只改姿势段;要换姿势也不换脸,垫图比纯关键词稳得多,姿势自由度是它的代价。这是 2026 年 3 月用本地 webui 跑 120 张图得出的实测结论,纯侧脸仍是两种方法的共同盲区。先把角色卡按三层结构改一遍,再谈一致性。
sd角色提示词最难的不是把图画好看,是让同一个人在第三张图里还认得出来。2025 年 11 月我给一部短漫做分镜,主角出到第五格就换了张脸,群里读者以为我中途换人设。挺丢人的。那之后我把固定脸型当成正经课题,2026 年 3 月专门跑了一轮对比实验,这篇就是那份实验记录。
先交代条件:本地 SD webui(AUTOMATIC1111 版 stable-diffusion-webui),二次元 checkpoint,采样 30 步,CFG 7,出图 768×1024。两种方法各跑三个姿势——正面站姿、坐姿侧身、回眸——每个姿势 20 个种子,合计 120 张,加上复跑的废片大约 150 张。判定标准很朴素:眼色、发型、脸型三样不变,一眼认得出是同一个角色,才算成功。
sd角色提示词的锁脸三层结构
锁脸靠三层:五官细节词放最前面加权重,发型词整段原样复用,种子锁死后只改姿势段;缺任何一层,脸都会开始漂。这是我用几十张废片换来的角色卡骨架,先照着改卡,再看下面的对比数据。
第一层是五官字段。把脸拆成不可妥协的几项:眼色、瞳孔细节、脸型、脸上的固定标记。我那个角色写的是「red eyes, mole under right eye」,眼色直接上权重,(red eyes:1.3)。位置比辞藻要紧,这些词必须挤在提示词前四分之一段里。我试过把 red eyes 挪到第 40 个 token 之后,同种子跑 20 张,红瞳命中从 17 张掉到 9 张,位置就是这么大的一方权重。
第二层是发型。别只写 long hair,写成「silver hair, high ponytail, black ribbon」这样一小段,每次出图原样粘贴。发型是侧脸唯一能救脸的字段,为什么这么说,后面翻车案例里讲。
第三层是种子。锁种子只对「同模型、同参数、同提示词长度」成立,换 sampler 或者加减一个词,骨架就变了。老实讲,种子是三层里最脆的,但正面姿势它最省钱。权重语法还不熟的,可以先看这篇 sd 提示词的权重语法和入门顺序,再回来接着改卡。
两种方法各跑 60 张,差距全在侧脸上
关键词锁定 60 张成了 39 张,垫图成了 53 张;垫图稳,但侧身姿势被参考图带跑 13 张、画风被带偏 9 张,代价同样清楚。
实验 2026 年 3 月 14 日开跑,正面那组先出,关键词锁定 20 个种子成了 18 个,我当时觉得这实验白做了。第二天切到坐姿侧身和回眸,风向变了:侧身 20 张成 14 张,回眸那组接近纯侧脸,20 张里 13 张换了个人,红瞳变紫瞳,马尾变披发。垫图那组用一张定卡图做底,重绘幅度 0.55——这个数是我按 0.05 一档从 0.45 试到 0.6,四档各 10 张后留下的折中——回眸 20 张成了 15 张,基本盘稳很多。
| 对比项 | 关键词锁定 | 垫图(重绘 0.55) |
|---|---|---|
| 正面站姿成功率 | 18/20 | 20/20 |
| 坐姿侧身成功率 | 14/20 | 18/20 |
| 回眸(近纯侧)成功率 | 7/20 | 15/20 |
| 姿势自由度 | 高,姿势词随便换 | 低,被参考图带跑 |
| 画风稳定性 | 跟模型走,不漂 | 会被参考图带偏,我翻车 9 张 |
| 上手成本 | 低,改词就行 | 得先有一张满意的定卡图 |
| 我更常用 | 定卡阶段 | 铺量阶段 |
垫图赢在脸,输在姿势和画风。姿势词写得再花,底图的构图感照样渗进来;我的参考图是厚涂风,60 张里带偏了 9 张。所以我的用法是先用关键词锁定法定卡,卡定了再用垫图批量铺姿势,两条腿走路,不二选一。最终定稿的一组三张是:seed 331247 正面站姿、seed 331248 坐姿侧身(右眼局部重绘补过一次)、seed 331250 回眸(垫图 0.55)。三个姿势,一张脸,短漫编辑那边一次过稿。
翻车案例:侧脸一换,人就换
侧脸丢掉的恰恰是权重最高的眼睛词——五官细节没地方挂时,模型会拿训练集里最常见的侧脸少女顶上,发型词一松就彻底换人。
为什么偏偏是侧脸?(red eyes:1.3) 这类词画正脸时全脸有八成像素可挂靠,切到回眸只剩一只眼睛,权重再高也没处使劲,模型就近取材,给你一张「平均侧脸」。3 月 16 日我复跑回眸组,20 张里红瞳只剩 7 张,其中 3 张连脸型都圆了,看着像她表妹。真离谱。
救法有两个。一是把可辨识字段从五官挪到侧脸可见的地方:发饰、耳坠、痣的位置,我加了一条「black ribbon, single earring」之后,回眸成功率从 7/20 拉到 11/20。二是垫图,15/20 就是这么来的。话说回来,有一张垫出来的侧脸其实挺好看,就是已经不是我那个角色了。
我个人觉得,关键词锁定的天花板就在这:它锁得住正面和四分之三侧,锁不住纯侧。要分镜级的全侧脸一致性,还是得局部重绘补脸或者上 LoRA,提示词这套是零成本保底,不是终点。
回到开头那部短漫:现在主角出到第十二格,脸一次没丢过,靠的就是一张三层结构的角色卡加两张垫图定卡。sd角色提示词写到后面,拼的不是词量,是纪律——字段写死、种子记档、每换一个姿势先跑三张验脸,成了再铺量。你手上那个老变脸的角色,今晚就能按这套流程锁回来。
常见问题
固定种子和固定提示词是一回事吗?
不是。种子锁的是构图骨架,提示词锁的是长相,两边同时不动脸才不动。只改姿势词跑同一种子,大部分图姿势跟着变,脸还认得出;可换个 sampler,同种子同词照样换人。
垫图会不会把画风也一起抄过来?
会,重绘幅度低于 0.5 时尤其凶,我的厚涂参考图 60 张里带偏了 9 张。想只借脸不借画风,把幅度提到 0.6 左右,脸的保持会掉一点,风格渗透少很多,我最后停在 0.55 折中。
纯提示词能把一致性做到多少?要不要直接上 LoRA?
我的数字是 65%(39/60),姿势不极端的话够用。要做漫画分镜、三视图立绘这种硬要求,LoRA 或者 ControlNet 参考才是正解,提示词法是先跑通流程的保底,两者不冲突。
角色卡里的词用英文还是中文?
我两组都试过,同一模型下英文词的脸部命中率高出一截,中文词多半被当成风格描述消化掉了。卡本体用英文写,旁边用中文注释记字段含义,方便自己回看。
延伸阅读
角色一致性常和分镜、脸部细节两件事绑在一起,这两篇可以接着看:ai漫画提示词怎么写?分镜格和角色一致性、ai脸部提示词怎么写?五官描述的优先级。