想把 Elements Claw 接进材料筛选流程,卡点通常不在工具本身,而在两件事:把它放在哪一步,以及接受它的输出到哪一层为止。如果现有流程里已经有人工初筛、取样送检和准入结论这几段,那么工具能插进去的位置多半在初筛这一段,作用是产出候选和线索,而不是替人下准入结论。下面把嵌入点、输入输出约定和人工复核条件拆开写,方便按自己的材料体系替换。
把 Elements Claw 放进材料筛选流程,建议先限定在“有明确输入、输出可校验、失败可退回人工”的那一步,通常用它产出候选集,而不是直接给材料准入结论。接入前先把现有流程的判断动作和搬运动作分开,再选一个可回滚的嵌入点,并约定必填字段与输出结构。凡是候选集中在同一体系、约束被临时放松、输出缺少依据说明、输入输出 ID 对不上的情况,都要停下来转人工复核。
把现有筛选流程逐步写下来并标出判断点
接工具之前先做一件事:把现在这条流程按步骤写出来,并逐行标注这一步是“判断”还是“搬运”。判断动作的特征是需要主观取舍、存在多个可接受答案、结果会影响下游准入;搬运动作的特征是输入到输出是确定的映射,换个执行者结果应该一样。工具适合接手搬运和半结构化的初筛,判断动作里越靠近准入的那一段越要留给人工。
可以先用下面这张表模板把流程填出来,执行者一列写清是人、脚本还是工具,最后两列决定后面能不能把工具放进来。
| 步骤 | 动作 | 输入 | 输出 | 执行者 | 是否含判断 | 可否回滚 |
|---|---|---|---|---|---|---|
| 1 | 材料清单汇总 | 各来源材料表 | 合并后的候选表 | 脚本 | 否 | 是 |
| 2 | 字段对齐与去重 | 候选表 | 统一字段的记录 | 脚本 | 否 | 是 |
| 3 | 按体系或用途归类 | 统一记录 | 分组结果 | 人工或工具 | 是 | 是 |
| 4 | 初筛出候选 | 分组结果 + 约束条件 | 候选集 | 人工或工具 | 是 | 是 |
| 5 | 取样与送检 | 候选集 | 检测记录 | 人工 | 否 | 否 |
| 6 | 准入结论 | 检测记录 + 人工评估 | 准入或淘汰 | 人工 | 是 | 否 |
填完之后,第 3、4 步是候选的嵌入位置,第 6 步不要接工具。如果第 4 步的约束条件本身还经常变,那它暂时不适合交给工具,因为约束不稳时输出也跟着不稳。
选出一个可回滚的嵌入点
嵌入点的选择标准建议就三条:输入字段明确且已清洗、输出结构可校验、失败时能整批退回人工而不污染下游。满足这三条才叫可回滚。第 4 步通常最合适,因为它的输入是第 2、3 步产出的干净记录,输出是候选集,人工复核后仍要走第 5 步取样,误判不会直接变成准入结论。
接入方式不必一上来就流水线化。先用手动触发、整批处理、结果落盘,跑顺了再考虑加频次。下面是一份通用调用骨架,字段名按工具实际支持的参数替换,重点在 dry_run 和输出结构约定上。
{
"batch_id": "sieve-<批次标识>",
"task": "sieve",
"input": "candidates.jsonl",
"constraints": {
"体系": "<目标体系,留空表示不限>",
"关键阈值": "<写清字段名和取值>"
},
"output_schema": ["id", "decision", "reason", "evidence"],
"dry_run": true
}
建议顺序是:先 dry_run 空转,只确认输入能被正确解析、条数对得上;再小批量正式跑,人工逐条看输出结构是否符合 output_schema;确认结构稳定后再放到完整候选表。失败或输出结构不符时,直接丢弃整批输出、把第 4 步退回人工,不要保留半截结果混进下游。
用记录确认每轮任务的实际输入与产出
每轮任务都要留一份可追溯记录,否则出问题时无法判断是输入变了还是输出变了。建议至少留存:批次标识、输入文件名与条数、输入内容摘要(哈希或校验值)、完整任务参数、输出原始文件、人工修改记录、被丢弃条目及丢弃原因。任务参数要留全文,不要只留“跑过一次初筛”这种描述。
比对的顺序是固定的:先比条数与 ID 集合,再比字段结构,最后抽看理由。输入 ID 集合减去输出 ID 集合,剩下的就是未被处理的条目;输出里出现输入没有的 ID,直接视为异常批次,需要重跑。输出理由字段如果只写结论、不写依据来源,标记为待复核,不能因为“看起来合理”就放进候选集。
| 项目 | 约定 | 校验方式 |
|---|---|---|
| 输入粒度 | 一行一条材料记录,带稳定 ID | 统计条数、检查 ID 唯一 |
| 必填字段 | ID、材料名、体系或来源、关键约束字段 | 缺字段的行单独列出,不参与本轮 |
| 输出结构 | 每条 ID 对应结论、理由、依据来源 | ID 集合与输入逐项比对 |
| 不确定表达 | 允许“无法判断”,不硬给结论 | 统计无法判断的条目并抽看 |
| 失败处理 | 整批退回人工,不部分写入 | 输出条数与输入条数是否一致 |
定义人工复核的触发条件
复核条件要写死,不写在流程里就等于没有。下面几条命中任意一条就停下来,不要先看结论再看条件。
- 候选集中在同一体系或同一来源:可能是输入偏差或约束设置过窄。复核动作:回看输入分布,确认是否漏掉了其他体系的材料,必要时放宽来源限制后重跑。
- 约束被临时放松:为了凑候选数而改阈值,输出就失去了可比性。复核动作:把改过的参数单独记一条,本轮结果只作参考,不作为准入依据。
- 输出缺少依据说明:只有结论没有理由和依据来源。复核动作:该条标记待查,人工补齐依据后再决定去留。
- 输入输出 ID 对不上或条数不一致:复核动作:整批重跑,确认输入解析无误后再继续。
- 结论落在阈值边界附近:边界附近的判断对参数敏感。复核动作:边界条目单独列出,由人工判断或送检确认。
- 与上一轮结果差异明显:在输入没大改的前提下,差异本身就是信号。复核动作:对比两轮参数记录,定位是哪一项变化导致的。
落地时可以把这几条写进流程文档的“出口”位置:工具输出只能进入候选清单,不能跳过人工复核直接进入取样或准入。边界划清之后,Elements Claw 承担的是降低人工初筛工作量、给出待查线索;哪些材料能通过,仍然由带检测记录和评估依据的人工环节回答。