Runway Gen-3 的提示词框看起来只是输入一句话,但生成的每个镜头都在回应提示词里的名词排序、修饰词密度和动词方向。多数不稳定结果,不是模型随机,而是提示词里缺少可被识别的结构层次。从界面内的官方示例和自己的生成历史里,可以梳理出一套固定写法:主体、场景、风格、镜头语言四要素依次排列,再配合场景限定词和运动方向词,之后用历史生成缩略图反推哪些词真正被模型读取。
在 Runway Gen-3 中,提示词有效度不取决于句子长短,而取决于四类要素是否齐全:主体、场景、风格、镜头语言。建议每次生成前把提示词写成四段式结构,再用具体名词替换宽泛场景词,最后通过历史生成缩略图对比同类型提示词的出图成功率。需要结合当前账号的历史记录确认哪些风格词确实生效,不承诺固定生成效果。
拆解提示词的基本结构
把官方示例拆开看,能稳定出图的提示词几乎都包含四类信息:主体、场景、风格、镜头语言。主体是画面里必须出现的人或物;场景限定环境;风格决定视觉基调;镜头语言控制运动趋势。可以按这个顺序写提示词,模型对名词序列的敏感度通常高于形容词堆砌。这里给出一个基础模板:
[主体],[场景],[风格],[镜头语言]代入示例就是:
一个穿雨衣的短发女人,站在霓虹巷子里,赛博朋克风格,镜头缓慢左移把主语放在句首,模型会先确认“谁在画面里”,然后是“在哪儿”、“什么视觉基调”、“镜头怎么动”。反过来写,例如把风格词放在最前,画面主体容易牺牲在细节里。建议每次生成前,把四类要素逐项列出来,缺少任何一类都先不要点击生成。
用场景词限定画面内容
场景词的颗粒度直接决定背景元素是否失控。例如“街道”会同时触发柏油路、人行道、招牌、树木、车辆等多种元素,模型根据概率随机决定保留哪些;换成“霓虹巷子”,光线颜色、墙面材质和景深层次同时被约束,随机面窄很多。
建议把宽泛场景词替换成包含环境类型和光线条件的复合词:
- “街道”→“雨后柏油路的窄巷”
- “森林”→“晨雾密集的松树林”
- “房间”→“只有一盏台灯的书房”
在输入框里演示一个完整写法:
一个穿雨衣的短发女人,站在雨后柏油路的窄巷里,赛博朋克风格,镜头缓慢左移场景词不需要塞满;环境类型留给主体,材质和光线留给背景。如果同一场景词反复出图都偏暗或偏乱,优先替换场景词,不要动主体描述,这样能直接判断是哪一部分描述没有生效。
添加风格词与运动方向
风格词和运动方向词在提示词里承担不同任务。风格词约束材质、光线和色彩关系,例如“赛博朋克”会把暗部压深、亮部偏霓虹色;运动方向词控制画面动态趋势,例如“镜头左移”会让背景产生横向偏移。在句子末尾追加运动方向词,是最简单的稳定写法:
一个穿雨衣的短发女人,站在雨后柏油路的窄巷里,赛博朋克风格,镜头缓慢左移这句提示词里,风格词紧贴场景,运动方向词放在句尾。如果写成“镜头缓慢左移,一个穿雨衣的短发女人……”,模型会优先服从运动逻辑,主体构图可能受影响。建议保持“主体、场景、风格、镜头语言”的词序。在未确认当前风格词稳定生效前,不要同时替换风格词和运动方向词,一次只改一个变量。
通过历史生成记录校准预判
生成历史是判断提示词有效度的最直接依据。每次生成后,回到历史记录里查看缩略图,不需要逐张点开大图。先按三项标准给缩略图分类:主体是否符合描述、场景是否符合描述、风格是否符合描述。三类都符合的提示词可以留作模板,后续只替换主体名词复用它。
判断出图成功率要看连续结果,不要只看单次。至少保留三个生成结果再作修正;单次生成失败可能来自模型状态波动,连续多次失败才说明提示词结构本身有问题。对比同类型提示词时,比较的是主体是否清晰可辨、场景是否贴合描述、风格是否统一,不是主观审美。假设同一个“霓虹巷子”提示词连续生成两张场景完全不同,就说明场景词还需要具体化。先调整场景词,保留原有的风格词和运动方向词,再重新生成,观察缩略图是否变得更稳定。
需要结合当前账号的历史记录确认哪些风格词确实生效;不同账号的历史积累不一样,不能拿别人的成功率当作自己的标准。