ManClaw 出分镜图与角色音、合成漫剧最容易返工

文章导读
用 ManClaw 做漫剧时,返工通常不是平均分布在这三个环节:出分镜图的返工最容易被误判成“模型不行”,实际多数是角色卡与镜头描述混在一起改;角色音的返工多半来自整段重录,而不是某一句话;合成环节的返工常被当成生成问题,实际出在转场和字幕时间轴。判断顺序建议是先把问题落到具体镜号、句号、衔接点,再决定改哪一层,最后只重跑受影响的最小单元做对照。
📋 目录
  1. Ⅰ 把需要返工的分镜图按角色和构图两类分开
  2. Ⅱ 在角色音片段里逐句核对语气与角色设定是否匹配
  3. Ⅲ 在合成片段里找出转场和字幕最容易出错的几处
  4. Ⅳ 按分类结果只改对应环节,再重跑一次做对照
A A

用 ManClaw 做漫剧时,返工通常不是平均分布在这三个环节:出分镜图的返工最容易被误判成“模型不行”,实际多数是角色卡与镜头描述混在一起改;角色音的返工多半来自整段重录,而不是某一句话;合成环节的返工常被当成生成问题,实际出在转场和字幕时间轴。判断顺序建议是先把问题落到具体镜号、句号、衔接点,再决定改哪一层,最后只重跑受影响的最小单元做对照。

处理方向是缩小修改粒度:分镜图按“角色形象不一致”和“画面元素缺失或多出”分两类,各自记录镜号;角色音按角色逐句比对台词与人物设定,只标记需要重录或调语速的句子;合成阶段按镜头衔接点检查画面跳变、按台词对齐检查字幕时机。三类改完各自只重跑一次,用同一镜号的新旧版本对照。边界是这套做法依赖任务命名和日志能对应到具体镜号,命名混乱时先补编号。

把需要返工的分镜图按角色和构图两类分开

拿到一批分镜图后不要直接重出,先做一次分类。判断依据是:问题出现在“这个角色长得不像他”,还是“这一镜该有的东西没画出来”。同一角色跨镜的发型、服饰、配色、脸型漂移,归到角色类;景别不对、道具缺失、多出无关人物、背景与场景描述不符,归到构图类。分类动作本身要落到镜号上,例如 shot_012 角色类、shot_019 构图类,而不是只写“这一批图有问题”。

返工类别典型现象记录字段最小修改动作验证方式
角色类同角色发型、服饰、配色跨镜漂移shot_id、character_id、角色卡版本只改角色卡描述或参考图,镜头描述不动该镜图与角色卡参考图并排比对
构图类缺道具、多人物、景别与镜头描述不符shot_id、缺失或多出的元素、镜头描述原文只改该镜的镜头描述文本,角色卡不动逐条核对镜头描述关键词是否在图里出现

记录镜号的通用做法是让出图产物按镜号落盘并带版本号,同时维护一张返工表,字段至少包含 stage、unit_id、class、observation、action、rerun_scope。这样后面重跑时可以按 unit_id 精确挑出要重出的镜,而不是整批重来。下面是可以替换成你自己目录的落盘与记录骨架:

shots/  shot_012/    image_v1.png    image_v2.png    character_card: lin_v2    prompt.txtrework.csv
stage,unit_id,class,observation,action,rerun_scopeimage,shot_012,character,hair color drift,edit character_card lin_v2,shot_012image,shot_019,composition,missing prop umbrella,edit prompt.txt only,shot_019

需要结合环境确认的一点是:如果你的出图日志里没有稳定的镜号字段,先在任务命名或日志输出里补上,再谈按类重跑,否则分类结果无法回流到具体镜。

在角色音片段里逐句核对语气与角色设定是否匹配

配音返工多数发生在“整段重录”这个动作上,而真正有问题的往往只有几句。核对方式是按角色分组,把该角色的全部台词行导出成一张表,逐句听原音频,对照人物性格设定判断语气是否冲突,例如设定是冷静克制,实际这一句却配得急促上扬。逐句记录的内容包括角色 ID、句 ID、起始时间、台词文本、性格关键词、实际语气、处理结论(保留、调语速、重录、改台词文本)。

char_id,line_id,start,text,persona,issue,actionlin,line_0234,00:01:12,我不去,冷静克制,语速偏快尾音上扬,adjust speed 0.95lin,line_0261,00:01:58,随便你,冷静克制,与设定一致,keep

最小修改动作分三种:只调该句的语速或情绪参数、只重录这一句、先改台词文本再重录。判断顺序建议是先看文本本身是否与人物设定冲突,文本没问题再动配音参数。验证方式是只重跑这一句,拼回原片段听上下文衔接,确认换气点、音量与相邻句没有明显断层。

ManClaw 出分镜图与角色音、合成漫剧最容易返工

在合成片段里找出转场和字幕最容易出错的几处

合成阶段的返工要单独定位,不要和出图、配音混在一起归因。检查动作有两个方向:一是按镜头衔接点逐个看,重点看镜 A 末帧到镜 B 首帧之间运动方向、光线、景别、人物位置是否跳,记录为 cut_A_B;二是按字幕条逐个看,核对字幕出现和消失的时间戳是否与对应台词对齐,记录为 subtitle_N。出错位置落到衔接点编号和字幕条编号,而不是笼统写“合成有问题”。

cut_id,from_shot,to_shot,symptom,actioncut_012_013,shot_012,shot_013,画面硬跳方向反转,set fade 6fsubtitle_id,line_id,in,out,symptom,actionsubtitle_017,line_0234,00:01:12.00,00:01:13.40,字幕晚于台词出现,shift in -0.3s

这里要区分一个判断:如果画面跳变的原因是镜头本身内容不对,那属于分镜图环节,回上一节处理;只有镜头内容没问题、单纯是切换方式和字幕时序不对,才留在合成环节改。验证方式是把改完的衔接点和字幕条单独导出看一遍,再放回整段连播确认没有新的不同步。查看片段时长这类基础信息可以用通用命令确认,避免把“字幕不同步”误判成“音频被裁掉”:

ffprobe -v error -show_entries format=duration -of csv=p=0 out/shots/shot_012.mp4

按分类结果只改对应环节,再重跑一次做对照

修改顺序建议固定为:先改角色卡再重出图,只重跑角色类的镜号;再改台词文本(如有必要)后重配音,只重跑被标记的句;最后重新合成,验证衔接点和字幕条。这个顺序的原因是角色形象一旦变化会影响后续所有镜,先定角色再定其它,可以少返工一轮。

  1. 角色类分镜图:只改角色卡或参考图,按 rerun_scope=shot_id 重出,构图类镜号本轮不动。
  2. 构图类分镜图:只改镜头描述文本,角色卡不动,避免把两类问题混进同一次改动。
  3. 角色音:只重跑 action 不为 keep 的句子,其余句子沿用原音频。
  4. 合成:前两步产物稳定后再重跑,只针对记录的 cut_id 和 subtitle_id 调整。
# 占位骨架:[image_runner] 等命令名替换成你环境里的实际入口# 只重跑角色类镜号awk -F, 'NR>1 && $1=="image" && $3=="character"{print $6}' rework.csv | xargs -I{} [image_runner] `--shot` {} `--out` out/shots/# 只重跑需要处理的台词句awk -F, 'NR>1 && $7 !~ /keep/ {print $2}' rework.csv | xargs -I{} [voice_runner] `--line` {} `--out` out/voice/

重跑验证的关键是保留旧版本,用同一镜号、同一句号的 v1 与 v2 并排比对,一次只改一类问题。如果一次改动同时动了角色卡、台词和转场参数,返工归因就会失效,下一轮还是不知道问题出在哪。