sd绘画多人提示词怎么写?多人物不糊脸的分区技巧
先给答案:多人糊脸不是玄学,是所有描述词挤在同一个区域里互相打架。用REGION类分区语法把每个人锁进自己的格子,两人档的可用率实测能从四成出头拉到七成半;四人档则要先想清楚,值不值得为两成成率硬跑。
sd绘画多人提示词最怕的不是画风崩,是脸崩。两个人挤成一张脸,三个人长出四只手,多数时候不是模型不行,是所有人共享了同一片画布。结论先放这里:想稳定出多人同框,就得用REGION类的分区语法把画布切开、让人各归各位,光靠把词写漂亮救不回来。
先分清REGION类语法:插件矩阵、纯BREAK、节点拼区域
REGION类语法干的是同一件事:把画布切成几块,每块喂自己的提示词,三人以上不分区基本没有出路。但「切」这个动作有三条路,成本差很多。
SD原生的BREAK只能切断上下文权重,切不开画布。我拿纯BREAK跑过一组对照:同一段两人提示词,只靠BREAK隔开,20组40张里能用的6张,两张脸融在一起的占大半,剩下的是脸分开了、身体连成一个。挺离谱的,但这就是不装插件的日常。
真正把区域切开的是两类写法。一个是装Regional Prompter插件,用ADDBASE和ADDROW的行内语法做矩阵分区,上手最快;另一个是ComfyUI那边,没有对应语法,靠ConditioningSetArea加ConditioningCombine两个节点手动拼区域,精度更细但搭得慢。我个人觉得,手写派选插件,节点派选ComfyUI,没有第三解。
| 写法 | 上手耗时 | 两人可用率(实测) | 三四人表现 | 我的评价 |
|---|---|---|---|---|
| 纯BREAK | 零 | 约15% | 基本不行 | 只配当对照组 |
| Regional Prompter矩阵 | 约半小时 | 约75% | 三人35%、四人20% | 我的主力 |
| ComfyUI SetArea节点 | 一小时起步 | 约70% | 和插件接近 | 精度高,搭得慢 |
sd绘画多人提示词的两人档实测:四成拉到七成半
两人图是分区的甜点区:全局词进ADDBASE,ADDROW切两行各写一人,可用率从四成出头拉到七成半。模板可以直接抄。
我常用的写法长这样:
ADDBASE 2girls, cafe, window light ADDROW 1girl, black long hair, red cardigan, reading ADDROW 1girl, blonde bob, blue shirt, drinking latte
几个数字记一下。竖图768×1024起步,每个区域的宽度低于350像素左右脸就开始糊,这是我这批测试里最硬的一条线;divide ratio填1,1,即上下对半。同一底模同一批种子,80张批量里调参前可用34张,约四成出头;把相邻区域的服装从相近色改成红蓝对撞、再按先发型发色、后瞳色、最后表情的顺序排五官词之后,可用57张,七成半。五官词的顺序我是照试出来的五官描述优先级排的,顺序反了区域之间会互相渗透,链接放这:五官描述的优先级怎么排。
三人到四人:掉得最快的不是脸,是区域边界
三人档可用率掉到三分之一上下,四人档只剩两成左右,失败多半不是糊脸,是区域接缝和复制人。区域数量每加一档,成率差不多砍半。
三人我基本只用竖排三行。麻烦出在中间那个人:上面人的发色会往下渗一撮,中间这位的肩膀上总挂着不属于他的颜色。挺离谱的。改法很土但管用——相邻区域的服装和发色直接拉开,红对蓝、黑对金,相近色别挨着放。
四人我试过一行四个,糊得没眼看;换成2×2矩阵好得多。上周三晚上帮朋友出一张四人乐队的封面,2×2连跑两批32张,最后能直接用的7张,剩下25张里接缝可见的占14张。老实讲,这个成率不算体面,但对比一行四区的3张,我已经很满意了。真不是玄学,区域越接近方形、单块面积越大,脸越稳。
三个高频翻车点:接缝、复制人、抢词
接缝靠低幅度整体refine一遍抹平,复制人靠负面词压住,抢词靠把共性词全部退回ADDBASE。这三个占了废片里的大头。
接缝是2×2四块交界处那条淡淡的色阶线。我的做法是出图后用0.3左右的重绘幅度整体过一遍高分辨率修复,接缝基本消失,人物结构也不会被顺手改掉。
复制人更气人:分区明明写了两个人,出图成了双胞胎。负面词里补clone、duplicate face这一组,权重比普通词高半档更见效,负面词怎么排我沿用了之前整理的负面词优先级,直接照抄没再调。
抢词是最隐蔽的一个:2girls、场景、光照这些共性词别在每个区域里重复写,全部塞回ADDBASE,区域里只留这个人的独有细节。重复写反而让区域互相抢,染出第三张脸。顺带提醒,如果同一张图要出同一个角色换姿势,脸型漂移比糊脸更难治,那属于固定脸型的角色一致性问题,分区语法帮不上太多。另外练写实多人图时,别拿真人照片当对齐目标,生成的脸也别用于冒充任何人,这条底线和出图率一样重要。
话说回来,分区语法解决的是「人别挤在一起」,不是万能药。两人档照抄模板基本一次成型;三人要接受三分之二的废片;四人以上我劝你先掂量,拆两次出图再合成,往往比硬跑省时间。回到开头那句话:多人图糊脸,根子在画布没分家。分了家,一半以上的问题就没了。
常见问题
装了Regional Prompter还是糊脸,先检查什么?
先看两个数:divide ratio有没有填、每个区域的实际宽度过没过350像素。插件装了不等于分区生效,ADDBASE漏写、行数比例没配,跑出来还是原来那坨。
不想装插件,还有别的办法出双人图吗?
有。先出一张单人图,再用局部重绘在留白处补第二个人,姿态用ControlNet OPENPOSE钉住。缺点是互动感弱,牵手拥抱这类接触姿势很难自然。
动漫模型和写实模型用分区语法,效果差多少?
动漫底模对多人兼容好得多,同一套参数两人档能摸到八成上下;写实模型糊脸率高一截,而且要额外留意生成脸的用途,别拿去冒充真人。
五个人以上的图还建议用分区吗?
不建议。我的记录里四人档已经掉到两成,五人再砍一半就没意义了,直接分层出图再合成,或者用3D软件摆好pose转线稿当底。