中标鹿筛出的商机不相关 / 是关键词太宽还是行业标签没选对?

文章导读
中标鹿筛出的商机不相关,通常不是单一原因:关键词决定的是「能捞多宽」,行业标签决定的是「往哪个方向捞」,排除条件决定的是「哪些明显不要」。这三层任意一层不对,结果列表上都会表现为「不相关」,所以不建议一看到噪声就直接去删关键词。更稳的顺序是从结果反查:先把这批不相关商机里反复出现的词标出来,再回头核对行业标签是否覆盖主营业务,最后确认排除条件有没有真正生效。每次只改一层,留观察期复核。
📋 目录
  1. 壹 抽 20 条不相关商机先标出重复出现的词
  2. 贰 检查行业标签是否覆盖主营业务
  3. 叁 把高频噪声词加入排除词并设观察期
  4. 肆 检查关键词是否只有一个泛行业词
  5. 伍 用可投商机名单确认有没有误杀
A A

中标鹿筛出的商机不相关,通常不是单一原因:关键词决定的是「能捞多宽」,行业标签决定的是「往哪个方向捞」,排除条件决定的是「哪些明显不要」。这三层任意一层不对,结果列表上都会表现为「不相关」,所以不建议一看到噪声就直接去删关键词。更稳的顺序是从结果反查:先把这批不相关商机里反复出现的词标出来,再回头核对行业标签是否覆盖主营业务,最后确认排除条件有没有真正生效。每次只改一层,留观察期复核。

不相关商机的归因顺序建议是:先统计高频噪声词,再核行业标签,最后查排除条件与关键词宽度。关键词过宽的典型特征是泛行业词单独出现、命中量大但抽样相关率低;行业标签选错的典型特征是一整批不相关商机都来自某个你并不做的标签。这两条线要分开验证,一次只调一层,并用新增商机做复核,避免收窄过头把可投商机误杀。

抽 20 条不相关商机先标出重复出现的词

不要凭印象改关键词。先从最近的结果里抽一批明显不相关的商机,按固定列记下来,重复出现的词自然会浮出来。建议的字段:商机标题、采购方名称、地区、命中的关键词、命中来源(关键词规则还是行业标签)、人工判断(不相关 / 待定)。抽 20 条左右够看出规律,抽太少容易被个别案例带偏。

序号商机标题采购方地区命中关键词命中来源判断
1(原样粘贴)(原样粘贴)(省/市)(例如:服务)关键词 / 标签不相关
2 不相关

记完之后,把标题里反复出现的名词单独整理成一行一个的文本文件,统计出现次数:

# noise_words.txt 里一行一个词,人工从上面 20 条标题里摘出来
sort noise_words.txt | uniq -c | sort -rn | head -20

如果标题已经导出成一行一条,也可以直接按已知的怀疑词统计命中行数(注意 grep -c 统计的是行数,一条标题命中多个词只算一次):

# noise_titles.txt 每行一条不相关商机标题
grep -c -e '培训' -e '食堂' -e '保洁' noise_titles.txt

把出现两次以上的词先记成候选噪声词,先不要急着排除。同时看一眼「命中来源」这一列:如果噪声集中在标签来源,问题更可能在行业标签;集中在关键词来源,才轮到关键词宽度和排除词。

检查行业标签是否覆盖主营业务

把当前已选的行业标签逐个列出来,对着实际业务判断,别只看标签名字像不像。判过窄还是过宽,用两条参照:一是过去成交或明确可投的客户,看他们所属行业有没有被现有标签覆盖,没覆盖说明标签偏窄;二是上面那批不相关商机,看它们是不是集中挂在某一个标签下,集中在同一个标签说明这个标签选宽了或者根本不该选。

已选标签对应的主营业务是否有可投/成交案例结论
(标签A)(写清做的是哪类采购)有 / 无保留 / 观察 / 删除
(标签B)(明确不做的写「不做」)无删除

明确不做的标签直接去掉,比改关键词见效更快也更安全。拿不准的标签先标「观察」,不要一次性大刀阔斧地删,否则很难判断后面的变化到底是哪一步带来的。

把高频噪声词加入排除词并设观察期

候选噪声词确认后,先加排除词,暂时不动关键词。排除词的写法建议用完整短语而不是单个字,比如排「培训」而不是排「训」,避免误伤正常标题。下面是一份可以替换的配置骨架,字段名按你实际用的规则编辑器调整:

{
  "exclude_keywords": ["培训", "食堂", "保洁服务", "庆典"],
  "exclude_match": "title_contains",
  "exclude_scope": ["title", "buyer_name"],
  "apply_to": ["keyword_rule"]
}

这里有两个替换项要确认:exclude_scope 决定排除词匹配商机标题还是连采购方名称一起匹配,只匹配标题可能漏掉一部分;apply_to 决定排除词只作用于关键词规则,还是连行业标签命中的商机一起排掉。如果排掉之后连标签命中的存量商机也消失,说明作用范围比预期大,需要单独确认。另外要留意全角半角、多余空格和大小写差异,这类问题会导致排除词看着加了、实际没生效。

中标鹿筛出的商机不相关 / 是关键词太宽还是行业标签没选对?

加完设一个观察期,建议三天到一周,别当天就下结论。观察期里每天记两项,自己数,不要预设结果:

  • 当天新增商机条数;
  • 其中标题含候选噪声词的条数。

观察期结束后重新抽一批新商机,看这批候选噪声词是否还成批出现。如果还在,先别继续加排除词,回头查是不是作用范围没选对、匹配字段写错,或者这些商机是从标签那条线进来的。

检查关键词是否只有一个泛行业词

排除词生效之后,再看关键词本身。只有一个泛行业词(比如「建筑」「信息化」「设备」「服务」这类)时,命中面天然很宽,和不相关商机同时出现是正常现象。判断办法是做组合对比,而不是凭感觉判断某个词「太宽」。

关键词组合命中量抽样相关率(人工估)
建筑填写填写
建筑 + 弱电填写填写
建筑 + 弱电 + 改造填写填写
建筑 + 弱电 + 地区填写填写

限定词优先选业务里真正有区分度的词:具体工序、设备类型、服务内容,或者地区。命中量下降但抽样相关率上升,说明确实是关键词太宽;如果加了限定词几乎没结果,多半是限定词选偏了,或者行业标签把范围压得太死,这时要回到上一节检查标签,而不是继续堆限定词。每次只改一个组合,记录改动前后的命中量,否则没法归因。

用可投商机名单确认有没有误杀

收窄之后最容易出的问题是误杀:原本可投的商机被排除词或限定词挡掉了。判断标准很直接——拿过去成交或已确认可投的商机标题,回放到新规则下,看是否还能命中。命不中就是误杀,命中但被排除词拦掉也是误杀。回放可以先用脚本粗筛:

# can_supply_titles.txt 每行一条历史可投商机标题
while read -r line; do
  if grep -q -e '培训' -e '食堂' -e '保洁' <<< "$line"; then
    echo "疑似误杀: $line"
  fi
done < can_supply_titles.txt

上面的排除词列表要与当前配置保持一致,改配置后重跑一次。发现误杀时,回退动作按顺序来:先把排除词从单词改成更精确的短语,再检查 exclude_scope 是否覆盖了不该覆盖的字段,仍然误杀就说明这个词不该排,退回观察状态。另一个折中做法是把宽口径规则单独保留一份、只做观察不推送,让窄口径规则负责实际推送,这样既能确认收窄效果,也不会丢掉潜在商机。

整条流程的边界是:所有判断都要能落到配置项、日志、命令输出或页面实际行为上,看不到证据就先不改。每次改动只动一层——要么动行业标签,要么动关键词与排除词,改完留观察期,用新增商机复核,别在同一天把三层一起改完。