Longcat-2.5-preview 读表格与写摘要、改措辞与压缩长文分开验

文章导读
如果你把读表格、写摘要、改措辞、压缩长文一次性都丢给 Longcat-2.5-preview,最后大概率只记得“好像还行”,却说不清哪类任务能直接用、哪类必须人工兜底。更可操作的做法是把这四类拆成两组:一组偏信息抽取与理解(读表格、写摘要),一组偏文本改写(改措辞、压缩长文)。同组内保持提示词不变,只换输入材料,分组记录结果。
📋 目录
  1. Ⅰ 为读表格准备一份带合并单元格与空值的小表
  2. Ⅱ 为写摘要准备一篇带小标题的长文
  3. Ⅲ 为改措辞和压缩长文各准备一份基线原文
  4. Ⅳ 两组任务分开跑,同一组内固定提示词
  5. Ⅴ 把四份结果并排看,只写本组之内的结论
A A

如果你把读表格、写摘要、改措辞、压缩长文一次性都丢给 Longcat-2.5-preview,最后大概率只记得“好像还行”,却说不清哪类任务能直接用、哪类必须人工兜底。更可操作的做法是把这四类拆成两组:一组偏信息抽取与理解(读表格、写摘要),一组偏文本改写(改措辞、压缩长文)。同组内保持提示词不变,只换输入材料,分组记录结果。

适用于还没确定模型边界的评估场景:先把读表格、写摘要归为理解组,把改措辞、压缩长文归为改写组,两组分开跑、组内固定提示词。验证方式是逐条比对事先写下的期望答案与原文可查信息,而不是凭印象打分。边界在于:理解组表现好,不能推断改写组也可用;反之亦然。每组只写本组材料下的可用部分与需人工补的部分。

为读表格准备一份带合并单元格与空值的小表

读表格不要用干净的小表。准备一份带合并表头、空值、单位不一致的表格,最好从真实 xlsx 导出,因为合并表头转成 Markdown 或 CSV 时常常被展平成空单元格,读数错误往往就出在这里。

  • 合并表头:例如“第一季度”跨两列,导出后其中一列的表头为空,看模型是否会把空表头归属到上一级。
  • 空值:某个单元格没有数据,看模型是留空、填 0,还是编一个数。
  • 单位不一致:同一列里混用“万元”和“元”,或“kg”与“吨”,看它是原样抄写还是统一换算。

每列期望得到的答案要在跑之前写下来,建议按列做卡片:列路径写成“一级表头 > 二级表头”,下面写期望值、可接受变体和判定依据,例如“依据 C3 单元格,值为 12 万元”。这样跑完能逐条对,而不是看着输出觉得“差不多”。

提示词可以这样固定:

只根据下方表格内容回答,不要补全缺失值,不要新增单位。
对每一列输出:列路径、是否为空、原值、原单位、统一单位后的值、依据的单元格坐标。
表格:
(粘贴表格)

为写摘要准备一篇带小标题的长文

写摘要选带小标题的长文,长度建议在能够完整覆盖一个主题但又不至于太长的区间。选文标准:有小标题或分节、包含具体数字与专有名词、有一两处否定表述(例如“不适用于……”),这样能同时看概括和忠实度。

Longcat-2.5-preview 读表格与写摘要、改措辞与压缩长文分开验

跑之前列两份清单。必须出现的信息:各小节主旨、关键数字及其限定条件、否定或例外句。不该出现的编造内容:原文没有的年份、机构名、因果关系、结论词(例如把“可能”写成“证明”)。

期望摘要要点清单示例:

- 第 1 节:主要观点 ______,依据 ______
- 第 2 节:数字 ______,限定词 ______
- 第 3 节:例外/否定句 ______
- 禁止出现:原文未提及的机构、时间、效果承诺

输出里出现清单外的机构或数字,就记为编造,不要因为“读起来通顺”而放过。

Longcat-2.5-preview 读表格与写摘要、改措辞与压缩长文分开验

为改措辞和压缩长文各准备一份基线原文

改措辞和压缩长文要用基线原文。基线保存方式:原始文件设为只读,复制一份到工作目录,命名带版本号和日期,例如 baseline-say-01.txt,改之前先算一次校验值(如 sha256sum),之后每次输出都回到这份基线,不在上一轮输出上继续改。

改动要求要写具体。压缩长文可以写“在保留小标题层级和下列关键词的前提下,把正文压缩到原文的 60%–70%”,并附关键词列表。改措辞写“保持原意和结论词力度,只替换表达方式,不新增事实、不删除关键限定词”。

改措辞要求:
- 保留关键词:______、______、______
- 不得新增:数据、机构、因果关系
- 结论词力度:原文“可能”不得改成“证实”
压缩要求:
- 目标长度:原文字数的 60%–70%
- 保留:小标题、关键数字、否定句

基线和要求一起存进当次运行目录,后续比对才有参照。

两组任务分开跑,同一组内固定提示词

两组任务分开跑,先跑理解组(读表格、写摘要),再跑改写组(改措辞、压缩长文)。换组时新开会话或清空上下文,避免表格内容影响改写输出。同一组内提示词保持不变,只替换输入文件;如果想试不同说法,另起一组编号,不要在原组里混着改。

Longcat-2.5-preview 读表格与写摘要、改措辞与压缩长文分开验

记录方式按“每次运行一行”来记,字段至少包括:运行编号、组别、任务名、输入文件、提示词文本的校验值、模型参数、输出文件、人工核对结论(可用“命中/需人工补/编造”三类标记)。表头可以先用:

run_id,group,task,input_file,prompt_sha256,params,output_file,check_result,note
A-01,理解,读表格,table-merge-null.xlsx,______,默认,out-A-01.md,需人工补,空值列被填0
A-02,理解,写摘要,article-01.txt,______,默认,out-A-02.md,命中,
B-01,改写,改措辞,baseline-say-01.txt,______,默认,out-B-01.md,命中,
B-02,改写,压缩长文,baseline-long-01.txt,______,默认,out-B-02.md,需人工补,删除了否定句

把四份结果并排看,只写本组之内的结论

四份结果并排看,只写各自组内的判断。理解组就看表格读数、摘要要点是否命中;改写组就看措辞是否保留原意、压缩后关键句还在不在。不要把理解组的结论写成“模型整体可用”。

结论句式可以这样写:“在本组材料下,合并表头读数可用,空值列需要人工回填”“在本组材料下,摘要能覆盖各小节主旨,但出现了原文没有的机构名,需要人工删除”“在本组材料下,压缩后小标题保留,否定句被删,需要人工补回”。每组只描述本组用到的材料类型和任务,不写“整体能力”“综合表现”这类跨组判断。