批量出同一角色的图,一致性差通常不是模型不给力,而是每次调用的角色描述本身在变。同一张脸要跨图复现,先得有一段逐字不改的特征描述,再去谈场景和姿态的变化。判断顺序可以按三条走:能不能把脸型、发型、服装、主配色写成固定字段;这一批图是不是从同一段前缀文字出发;改动的是不是只有场景和姿态。这三条里有一条不成立,反复重跑就只是在消耗调用次数,而不是在收敛角色。
适用场景是同一角色连续出图、需要凑成一套的情况:先把脸型、发型、服装、主配色写成一段固定前缀描述,每批调用逐字复用,只改场景与姿态,再把同批结果拼在一起,按四类特征逐项比对。偏移最明显的特征先补一条更具体的限定再重跑,用同一张检查表复核。边界在于:固定前缀能压低批次之间的外观漂移,但姿态变化大、遮挡多、镜头拉远时五官仍可能偏;描述写得再细也不等于完全可控,需要留出手动筛图的成本。
拆出角色不可变特征:脸型、发型、服装、主配色
这四类是要跨图保持一致的,先写下来,后面才有可比对的基准。每类最少要写清下面这些要素,缺一项,模型就有空间自己补,补出来的结果通常就是不一致的来源。
- 脸型:脸型轮廓(卵形 / 圆形 / 方脸)、下颌线条、眼睛形状与眼距、眉形、鼻梁与鼻头、嘴唇厚薄、年龄感、肤色。示例:“卵形脸,下颌线柔和,杏眼、眼距略宽,平直眉,鼻梁挺直,唇形偏薄,二十岁上下,浅暖肤色”。
- 发型:长度、分缝位置、刘海形态、发色、发质(直 / 微卷 / 卷)、扎法或披散、发饰位置。示例:“齐肩直发,中分,无刘海,深棕色,发尾自然内扣,左侧耳后别一枚小发夹”。
- 服装:上衣类型、领口、袖长、下装、整体廓形、材质、固定配饰。示例:“白色衬衫,小方领,七分袖,深蓝直筒长裤,腰间系细皮带”。
- 主配色:主色、辅色、点缀色,以及三者的占比关系。示例:“主色白,辅色深蓝,点缀色浅金,点缀只出现在配饰上”。
如果角色有多套造型,建议每套单独存一份模板,不要在一段描述里切换,否则同一批图里会出现服装混搭。
把不可变特征写进每次调用的前缀描述
做法是把上面四类特征拼成一段固定前缀,每一张图都从这段文字开始,后面再接这一批的可变部分。关键是前缀在批内批间都保持原样,不做同义替换——“齐肩直发”不要换成“及肩长发”,“深棕色”不要换成“栗色”。这类替换看起来意思相近,但会改变模型采样的语义落点,是外观漂移的常见来源。
[角色前缀 | 每批原样复制]
角色:{姓名或代号}
脸型:卵形脸,下颌线柔和,杏眼、眼距略宽,平直眉,鼻梁挺直,唇形偏薄,浅暖肤色
发型:齐肩直发,中分,无刘海,深棕色,发尾内扣,左侧耳后别小发夹
服装:白色小方领衬衫,七分袖,深蓝直筒长裤,细皮带
主配色:主色白,辅色深蓝,点缀浅金,点缀仅在配饰
[本批可变 | 见第 3 节清单]
场景:{}
姿态:{}
视角:{}
建议把这段前缀单独存成文件或变量,调用时用字符串拼接而不是手打,这样能避免某一次调用多打一个词、少打一个词。前缀和后缀之间用固定分隔符(比如换行加“场景:”)分开,方便快速核对哪一批改了哪些字段。
每批只改场景与姿态,其余字段逐字保留
可变字段建议限定在这几项:场景或背景、光照与色调、镜头与视角、姿态与动作、表情、构图比例、临时道具。除此之外全部逐字保留。一批里只改一到两项,是最容易定位问题的做法;一次改四项,出图不一致时无法判断是场景引起的还是姿态引起的。
- 第一批先只改姿态,场景保持最简,用来确认脸和发型能不能稳住。
- 稳定后再加入场景变化,姿态沿用上一批里表现最稳的那一个。
- 需要换视角时单独开一批,不要和换场景放在同一次调用里。
判断标准很直接:一批图拼起来,如果第一眼看不出是同一个角色,就先退回上一批的可变项数量,不要继续往下加。
把同批输出拼在一起,逐项比对四类特征
单张看容易放过偏差,拼在一起看才明显。建议按同一网格排列、统一裁到相近的取景范围,然后沿固定顺序逐项比对,一次只看一类特征,不要四类混着扫。每项用一个固定档位记录,便于后面判断先修哪一条。
- 脸型:看轮廓宽窄、下颌线、眼距。档位记录为一致 / 轻微偏移 / 明显偏移。
- 发型:看长度、分缝、刘海、发色深浅。同样三档记录。
- 服装:看领口、袖长、下装廓形、有无配饰。同样三档记录。
- 主配色:看主色是否被场景色压过去、点缀色是否扩散。同样三档记录。
记录方式建议每批一行,例如“批 3:脸型 一致,发型 轻微偏移(刘海变厚),服装 一致,配色 轻微偏移(背景偏暖)”。优先处理“明显偏移”的那一类,再考虑轻微项,不要每项都加描述,会把前缀拖得越来越长。
对偏移最明显的特征补一条更具体限定后重跑
找到偏移最明显的特征后,不要重跑同样的描述碰运气,而是给它补一条可判定的限定。补充描述要写成能被画出来的具体形态,而不是“更准确”“更符合”这种无法比对的词。
# 发型偏移:刘海变厚
原:齐肩直发,中分,无刘海
改:齐肩直发,中分,额头完全露出,两侧发丝贴在耳前
# 脸型偏移:下颌变尖
原:卵形脸,下颌线柔和
改:卵形脸,下颌宽度约为颧骨宽度的四分之三,下颌角圆钝
# 配色偏移:点缀色扩散到整件上衣
原:点缀浅金,点缀仅在配饰
改:点缀浅金,仅出现在腰带扣与耳饰,上衣保持纯白无纹样
一次只补一条,补完重跑时其余字段保持原样。跑完用第 4 节同一张检查表复核,逐项记一致 / 轻微偏移 / 明显偏移,和前一批的记录放一起对比:出现明显偏移的那一类降到轻微或一致,说明这条限定有效,可以并入固定前缀;没有变化,说明限定词本身没有被模型识别,换一个更具体的形态描述再试,而不是在同一句上反复加形容词。多类特征同时明显偏移时,先固定脸型和发型,服装和配色往后放——人脸不稳,后面几项也无法判断。