用 Muse Image 出图时,人像和场景的失败原因通常不一样:人像容易糊在五官和姿态没写清,场景容易空在只有元素堆砌、没有光线方向和前后景。分不清该往哪边加描述,就很容易一套写法套两种画面,结果是人物脸部含糊、场景像平面贴图。下面按出图类型拆开,给出可对照的操作步骤和可套用的模板。
适用场景:准备用 Muse Image 出人物画面或场景画面,但不确定描述该写多细、写哪些项。操作动作:先判断主体是人物为主还是场景为主,人像类把描述量集中在面部、姿态、视角,场景类先写光线方向和前中后景再补元素。验证方式:用同一主题各写一版,控制风格倾向词和画面比例不变,比较面部可辨度与画面纵深的差异。风险边界:这是描述重点的对照方法,不保证某个风格词或某组参数一定出确定结果,最终效果需要结合所用模型版本和出图设置确认。
先把出图需求分成人物为主与场景为主两类
分类只看一件事:出图后你希望观者第一眼看哪里。第一眼落在人的脸和身体上,就是人物为主;第一眼落在空间、光线、环境关系上,就是场景为主。可以再问三个问题:主体占画面比例大不大、画面是否依赖纵深来成立、去掉人物后画面还成不成立。三个都偏向前者,按人像类写;偏向后者,按场景类写。
混合情况很常见,处理方式是定一个主类,另一类只用一句话交代。人物站在街景里且以人为主,就按人像类写,环境只写“背景是傍晚街道,光线偏暖”一句;反过来以空间为主、人物只是尺度参照,就按场景类写,人物只写位置、朝向和大小,不写五官。判断错了主类,通常不是出不来图,而是出来的图“差一点”——人像没细节,或者场景没纵深。
| 对比维度 | 人像为主 | 场景为主 |
|---|---|---|
| 描述重心 | 面部结构、表情、发型服装、身体姿态、取景视角 | 光线方向与性质、空间层次、前后景、材质与尺度参照 |
| 必须写到 | 脸型五官、表情与视线、头部角度、身体朝向、景别 | 主光方向、光的软硬、前中后景各有什么、纵深线索 |
| 可以少写 | 环境细节、远处背景元素 | 面部五官、具体表情 |
| 常见问题 | 五官含糊、面部糊、姿态僵硬 | 元素平铺、画面空、没有远近关系 |
人像类描述里核对面部、姿态、视角是否写到
人像类描述写完先自查三类要素:面部、姿态、视角。每一类都不需要长句,但需要落到具体词上,不要只写“漂亮”“好看”“精致的脸”这类无法落地的形容。
- 面部:脸型与轮廓(鹅蛋脸、方圆脸、颧骨略高);眼型(杏眼、狭长眼、眼尾略微下垂);鼻与唇(鼻梁挺直、鼻头圆润、唇形偏薄);表情与视线(抿嘴微笑、神情放松,视线看向镜头偏左)。
- 姿态:身体朝向(正面、略微侧身、背对镜头回头);重心与手部(重心落在一条腿上、双手交叠在身前、一只手扶住衣领);肩膀与头部角度(肩线不完全正对镜头、下巴略微抬起)。
- 视角:机位高度(平视、略俯、略仰);景别(特写、半身、中景);主体位置(居中、偏画面左侧);镜头距离感(近距离近景、稍远的中景)。
写完后逐条对照,缺哪一类就补哪一类。三类里最容易漏的是视角,而视角往往决定脸在画面里是不是被拍清、有没有被裁到。
场景类描述里核对光线方向、空间层次、前后景
场景类描述不要先列元素,先写光线。光线方向决定明暗关系和立体感,缺少方向的场景通常看起来是平的。可用的表述例子:主光从画面左侧窗户斜射进来、顶光偏硬、逆光勾出轮廓、光源在远处偏右、散射光没有明显投影、傍晚低角度暖光从背景方向照过来。再补光的性质:硬光投影清晰、柔光过渡平缓、阴天散射光反差小。
空间层次按前、中、后三层写,并在描述里点明遮挡关系。可用的表述例子:前景是被虚化的桌面边缘和一只杯子、中景是主要对象所在的区域、远景是模糊的墙面与窗框;地面向画面深处延伸形成消失方向;远处有重复排列的柱子形成近大远小;空气中有轻微雾气让远景变淡。元素数量不必多,但每层至少有一个东西,画面才会有纵深。只写“房间里有很多东西”这类描述,通常会得到平铺的结果。
用同一主题分别按两类写法生成并对比
想确认差异是不是来自描述重点本身,需要做一次对照:主题、风格倾向词、画面比例保持不变,只改描述重点。比如同一主题“一个人在窗边看书”,人像版把篇幅放在面部、姿态、视角上,环境一句带过;场景版把篇幅放在窗光方向、室内前后景、纵深上,人物只写位置和朝向。
观察时按字段记录,不要只凭一次出图下判断。建议同一写法至少生成两到三次,看差异是否稳定复现。
| 记录字段 | 填写内容 | 观察重点 |
|---|---|---|
| 主题 | 两版保持完全一致 | 确认变量没被改掉 |
| 写法类型 | 人像版 / 场景版 | 区分对照双方 |
| 完整提示词 | 原样粘贴 | 方便回看哪句话起作用 |
| 固定项 | 风格词、比例、出图设置 | 固定项不同就不能归因到描述重点 |
| 面部可辨度 | 五官是否清楚、有无糊脸 | 人像版是否明显更清晰 |
| 姿态自然度 | 有无僵硬、肢体错位 | 姿态描述是否起作用 |
| 画面纵深 | 能否分出前景、中景、远景 | 场景版是否比人像版更有层次 |
| 缺失元素 | 漏掉了什么 | 决定下一版补哪一句 |
如果两版差异不明显,先检查固定项是否真的没变,再检查描述是不是写得太笼统,而不是直接换风格词。
整理两类模板并标注必须出现的要素
把上面核对过的要素固化成两份模板,【】内的位置在每次出图时替换,其余结构保留。人像模板:
主体:【年龄/性别/身份】,【脸型与面部轮廓】
五官:【眼型与眼神】,【鼻与唇的特征】
表情与视线:【表情】,看向【镜头/画面外侧某处】
发型与服装:【发型】,【服装颜色与材质】
姿态:【身体朝向与重心】,【手的位置】,【头部角度】
视角与构图:【平视/略俯/略仰】,【特写/半身/中景】,主体位于【画面位置】
光线:【光线方向与性质】,【色温倾向】
环境(一句带过):【地点与时间】
避免:【面部遮挡、模糊、过度磨皮】
场景模板:
空间:【地点】,【室内/室外】,【时间与天气】
光线:【主光方向】,【硬光/柔光/散射】,【低角度/顶光】
空间层次:前景【遮挡物或近处物件】,中景【主要对象】,远景【背景轮廓】
纵深线索:【地面延伸方向/重复排列/空气感】
材质与尺度:【墙面或地面材质】,【人物或物件作为尺度参照】
视角:【机位高度】,【广角/长焦压缩感】
避免:【元素平均摆放、没有前后遮挡】
两份模板的硬性部分是固定的:人像模板必须有五官、姿态、视角三行;场景模板必须有光线方向、前中后景三层。可替换部分是主体身份、地点时间、材质与色温倾向这些和具体画面绑定的内容。下次出图先判断主类,再套对应模板,混合画面按主类选模板、另一类只留一行,这样描述重点就不会串位。