纸袋管语法与措辞、论证和引用自己核、投稿前逐条过一遍

文章导读
润色工具能覆盖的是语言表层:拼写、基本语法、重复用词,以及一部分措辞替换;它不会替你判断某条文献的年份有没有被顺手改掉、某个数字的单位有没有被换、图表交叉引用是否还对得上。所以投稿前最后一遍必须自己走,顺序建议是先确认工具改了什么并抽检、再逐条核引用与数据、最后按目标刊物要求过格式并留痕。纸袋管这类工具跑完,工作只完成了一半,剩下的一半决定稿件能不能安心投出去。
📋 目录
  1. 列出工具已处理的项并做小比例抽检
  2. 逐条核对引用与参考文献是否被改动
  3. 核对数字、单位与图表说明和正文是否一致
  4. 按目标刊物要求过一遍结构项
  5. 保留改前改后两版并记录每处改动理由
A A

润色工具能覆盖的是语言表层:拼写、基本语法、重复用词,以及一部分措辞替换;它不会替你判断某条文献的年份有没有被顺手改掉、某个数字的单位有没有被换、图表交叉引用是否还对得上。所以投稿前最后一遍必须自己走,顺序建议是先确认工具改了什么并抽检、再逐条核引用与数据、最后按目标刊物要求过格式并留痕。纸袋管这类工具跑完,工作只完成了一半,剩下的一半决定稿件能不能安心投出去。

适用场景:已经用工具完成一轮语法与措辞润色、准备投稿的中文稿或英文稿。操作动作:先确认工具已覆盖的项并小比例抽检,再逐条比对引用、数字单位、图表交叉引用,最后按目标刊物要求过结构项。验证方式:用 diff 比改前改后两版,逐条打勾记录。风险边界:术语白名单和「不润色段落」设置能降低误改概率,但不能替代人工核对,参考文献与数值段落尤其要自己看。

先把责任分清楚,再谈顺序。下面这张表是工具侧和人工侧的分工边界,可以直接照着自己那篇稿子填。

环节工具通常可做必须自己做不通过时的处理
拼写与语法逐句修正主谓、时态、冠词、单复数抽检若干段确认原意未变回滚该段,并把涉事术语加入白名单
措辞与用词同义替换、去掉重复词确认专业术语和论证措辞没被弱化恢复原措辞,把术语设为受保护词
参考文献一般不应参与改写条目数、年份、作者字段逐条比对整段回滚,标记为不润色区域
数字与单位多数工具不改,但可能被顺带改动数字、单位、图表编号逐项核对以原始数据表为准回改
格式结构部分工具不处理或只做粗排按目标刊物作者指南逐条过按指南改完再提交
版本留痕工具一般不生成记录两版存档加改动理由表缺记录时补记,再进入下一轮

对应的复核顺序可以固定成七步,走完一步再进下一步,不要跳:

  1. 把改前稿另存为基线,这一份从此刻起不再改动;
  2. 检查工具配置里的术语白名单,以及参考文献、致谢、图表题注是否被设为不润色段;
  3. 抽检若干段,通过才继续,不通过先扩大抽检范围而不是直接放行;
  4. 比对参考文献条目数、年份、作者字段;
  5. 核对数字、单位、图表编号和正文交叉引用;
  6. 按目标刊物的作者指南过结构项;
  7. 生成改动记录,逐条标注是否已复核。

列出工具已处理的项并做小比例抽检

工具已经处理过的范围,通常包括拼写、基础语法、连续重复用词、明显病句、部分标点与空格。这部分不必逐句从头看,但也不能完全不看,需要小比例抽检来确认它没有越界改写。

抽检建议按段落抽,而不是按页抽。稿子较长时,每十段抽一段,总量不少于三段;二十段以内的短稿直接抽三段。抽检段落优先选含专业术语、因果论证、公式叙述的段落,因为纯描述段被改坏的概率低,抽了说明不了问题。判定方式是对着改前稿逐句比,满足三条即认为该段通过:原意没变、术语没被同义替换、没有新增原文里不存在的判断。三条里任意一条不满足,就回滚该段。

纸袋管语法与措辞、论证和引用自己核、投稿前逐条过一遍

如果同一类误改在抽检里出现两次以上,说明不是偶发,建议扩大到全篇对照,并把受影响的词加进保护列表。配置入口各家不同,字段名以你所用工具的实际配置项为准,结构大致是这样:

protect_terms:
  - 纸袋管
  - 孔径分布
  - 线性回归
do_not_rewrite:
  - 参考文献
  - 致谢
  - 图表题注
tone: academic-conservative

逐条核对引用与参考文献是否被改动

参考文献是最容易被误伤的区域:工具可能把年份当成数字顺手改掉,把作者姓氏当成拼写错误纠正,或者把两条文献合并。核对方法不复杂,先比数量,再比字段。

# 条目数:改前与改后应一致
# 方括号编号式

grep -cE '^\s*\[[0-9]+\]' draft.before.md
grep -cE '^\s*\[[0-9]+\]' draft.after.md


# 年份字段差异:只列年份,差异会直接显示
#### 改前

grep -oE '\b(19|20)[0-9]{2}\b' draft.before.md | sort | uniq -c

#### 改后

grep -oE '\b(19|20)[0-9]{2}\b' draft.after.md | sort | uniq -c


# 作者字段抽查:按行输出后人工扫一遍
grep -nE '[A-Z][a-z]+,? [A-Z]\.' draft.after.md

数量对不上时不要逐条去修,直接回滚整个参考文献段,再把这一段加入不润色范围。年份和作者可以按上面前后两份结果逐行对照,凡是有出入的条目,回到原始出处或你自己的文献库确认,不要凭印象选一个。正文里的引用标记同样要核,用 grep -n '\[[0-9]\+' 之类的写法把标记位置列出来,确认编号指向的文献没有错位,尤其是做过段落增删的稿件。

核对数字、单位与图表说明和正文是否一致

措辞替换本身不该动数据,但润色过程中重写句子时,数字和单位的归属关系很容易被模糊掉,比如「提高了 3 倍」被改成「有较大提高」,或者单位从小写换成大写。这一轮要保证的是数据表述和原始记录一致。

纸袋管语法与措辞、论证和引用自己核、投稿前逐条过一遍

检查项按四类走:数字本身、单位符号、图表编号、正文交叉引用位置。可以先把数字加单位的组合列出来,再人工逐条扫:

# 数字加单位,人工逐条核对
#### 改后稿
grep -nE '[0-9]+(\.[0-9]+)?\s*(%|ms|s|min|h|MB|GB|kHz|GHz|nm|mm|kg|mol|℃)' draft.after.md


# 图表编号出现次数,与图表实际数量对照
grep -oE '(图|表)[ ]*[0-9]+' draft.after.md | sort | uniq -c

不通过时的处理动作分三种:数字或单位不一致,以原始实验记录或数据表为准回改,不要以润色稿为准;图表编号错位,按图表在正文中首次出现的顺序统一重排,并同步所有交叉引用;题注与正文表述不一致,以题注为准修正正文里的结论性说法,题注保持简洁客观。正文可以换说法,但结论方向不能和题注冲突。

按目标刊物要求过一遍结构项

这一步是格式收尾,不同刊物的作者指南差异很大,摘要字数、关键词数量、参考文献样式、标题层级、脚注位置都要按目标刊物确认,不要凭上一次投稿的经验套用。

检查项怎么核不通过时的动作
摘要长度按刊物规定的字数或词数上限统计删掉背景铺垫,保留目的、方法、结果、结论
关键词数量数一遍实际个数,核对是否在要求区间内超出就合并近义词,不足就从标题和摘要里补
标题层级确认级数与编号样式符合指南把多余层级压平,编号统一成一套
脚注格式核对位置、编号方式、是否有字数或数量限制能移到正文的移到正文,保留的按样式重排

核这一遍时把作者指南和稿子并排打开,逐条在本子上或表格里打勾,不要只在脑子里过。凡是不通过的项,改完再回来确认一次,避免改一项又碰坏另一项。

纸袋管语法与措辞、论证和引用自己核、投稿前逐条过一遍

保留改前改后两版并记录每处改动理由

导师或审稿人追问「这处为什么改」的时候,如果只有一版终稿,解释起来会很被动。稳妥的做法是把改前稿和改后稿各存一份,并且给每一次人为改动留一条记录。

版本命名建议统一成「项目_阶段_日期_改动人」的形式,例如 paper_baseline_0415_ly.mdpaper_polished_0415_ly.md。不要用 final、final2、真的final 这类名字,隔几天自己都分不清哪份能投。每一轮自己动手改之前,先复制一份当前稿再改。

改动记录至少包含四个字段:位置、改动内容、理由、是否已复核。手改不多时用表格即可,条目多时用 CSV 或表格工具,字段结构如下,值是示例,替换成你自己的记录:

位置,改动内容,理由,是否已复核
3.2 第2段,提高 → 提升,同一段内重复用词,是
参考文献第7条,年份回滚,润色误改,是
图3 题注,补充单位,与正文单位表述统一,否

最后一步是过一遍「是否已复核」这一列,把标否的项清零,再确认两版文件都在、命名能对上号,这时才算真正投得出去。