讲一次翻车复盘。上个月接手一份八十多页的标书,前手是三个人接力改出来的:样式表里堆了六十多个样式,实际用到的不到十五个;正文里夹着上百个空段落;模板改了四轮,每一轮都留下几个"样式尸体"。我的任务是把它过一遍 AI 校对再交出去,结果一路踩了三个坑。这篇按时间线复盘,顺便把现在的标准流程整理出来。
坑一:把原文档整个丢给 AI
我的第一反应是把全文复制到网页版 AI 里校对。八十多页粘过去,要么被截断,要么格式全丢,AI 拿到的段落顺序都是乱的。后来接上察元AI文档助手的 MCP 通道才知道正规的读法:用 document_get_text 读全文,超过约 80k 阈值时工具会拦下来,要么明确 force,要么改用 document_chunks 分页分块读;而 document_meta 会先给出字数、段数和"是否建议分块"的提示,等于先体检再决定读法。
但更重要的是顺序问题:脏文档直接读,等于让 AI 连同样式尸体和空段落一起消化,token 全花在垃圾内容上。现在 Token 成本是实实在在的开销,长文档场景下,"先瘦身、再喂 AI"能省下不小一块,这比任何提示词技巧都来得直接。
坑二:不敢动样式表
第二个坑是心理障碍。样式表看着就吓人,清错了把排版毁了怎么办?我一开始只敢看不敢动。后来发现察元的文档批量里专门配了"统计已使用样式"这一步:先把正文实际用到的样式列出来,再执行清理未使用样式,只动"尸体",不碰"活人"。六十多个样式清完剩十几个,样式面板从滚三屏变成一屏半,后续任何人接手都不容易再点错样式。
复盘要点:先统计、后清理,这个顺序不能反。统计出来的清单本身也是一份交接材料——哪些样式真在用、用在哪些地方,附在说明里,接手的人不用再猜谜。另外共享模板要慎清——你不用不代表别人不用,动共享模板之前先和模板的主人打好招呼。
坑三:手工删空白行删到眼花
上百个空段落,我头铁用查找替换加手工删,删到凌晨两点,中间还删串了两段。其实文档批量里的"删除空白行"一键就完事。这种教训说出来很蠢,但人在赶工的时候,就是会先上手再上工具。记一句:凡是重复超过十次的操作,先停下来找批量入口。
现在的标准流程
复盘之后我固定了一套顺序,供参考。第一步,另存副本,保住原样;第二步,统计已使用样式,心里有底;第三步,清理未使用样式;第四步,删除空白行;第五步,让 AI 复核结构问题,比如这条提示词:
检查标题/条款序号(一、(一)、1.)是否层级混乱,批注指出
需要校对正文时,再加一道保险,先预览后写回:
先跑一遍校对(dryRun),汇总问题列表,不要先改正文;我确认后再写成批注
校对的 dryRun 只出问题清单不落盘,确认之后再转成批注,瘦身和校对两步都稳。
同门的批量兄弟
文档批量这套(清理未使用样式、统计已使用样式、删除空白行)在加载项里不是独苗。同门还有表格批量——导出或删除全部表格、自动行宽、刷新样式、按文字删行列、序号与样式、表格题注;以及图像批量——导出或删除全部图像、统一或清除格式、图像题注。交稿前的大扫除,按文档、表格、图像的顺序各过一遍,比想到哪修到哪有条理得多。样式面板清爽了,表格规整了,图片统一了,这份文档不管后面是送人审还是喂给 AI,都体面得多。
适用人群与边界
这套瘦身流程适合标书、论文、长报告的交稿前处理,尤其是接下来要交给 AI 做校对、摘要、翻译的文档——干净的输入,才是又便宜又高质量的输入。边界提醒:清理样式和删空白行都改动文档本体,务必先备份;瘦身解决的是"文档卫生",内容对不对、逻辑通不通,还得靠校对和人工把关,工具管不了。
一个脏文档在人手里是耐心问题,在 AI 手里是 token 问题。先瘦身再干活,两边都受益。