AI 幻觉引用拦在写作前:Academic Research Skills 防泄漏协议完整指南
【免费下载链接】academic-research-skillsAcademic Research Skills for Claude Code: research → write → review → revise → finalize项目地址: https://gitcode.com/GitHub_Trending/ac/academic-research-skills
引用全绿、格式全合规,但其中几条文献在任何学术数据库里都查不到——这才是 AI 学术写作最真实的险点。面向 Claude Code 的研究技能包Academic Research Skills(ARS)内置一套防泄漏协议(Knowledge Isolation,知识隔离指令),专治AI 幻觉引用。
一句话原则与 5 条硬规则
写论文时,优先用你本次会话提供的材料,而不是模型的"记忆"。
当你把研究问题简报、综述报告和带注释的参考文献表交给流水线后,写作代理会收到这样一组规则:
| 规则 | 大白话解释 |
|---|---|
| ① 事实性声明优先来自会话材料 | 你的数据说了算,模型的"常识"靠边站 |
| ② 每个论点必须可追溯到来源 | 无源的句子,一个字都不许写 |
③ 材料没覆盖的话题标记[MATERIAL GAP] | 缺口就亮出来,不拿记忆糊上 |
| ④ 不许引入参考文献表之外的新文献 | 想加引用?先开口要授权 |
| ⑤ Methods 只描述材料中记载的流程 | 实验步骤一步都不许"发明" |
注意,被限制的是事实性内容(声明、引用、数据、流程描述),不是语言能力——模型照样可以帮你把结构、行文和论证逻辑理顺。
看到 MATERIAL GAP 标记后,你该做什么
大纲需要的内容在材料里找不到时,AI 不会悄悄"圆"过去,而是打一个[MATERIAL GAP]标记,在下一个检查点把缺口摆到你面前。此时你只有两个动作:
- 补材料——把缺失的资料喂给流水线,继续推进;
- 授权 AI 补——补出来的内容会被打上
[LLM-SUPPLEMENTED]标签,一致性审查时这一段会被默认重点复核。
每一次"自由发挥"都会留痕:你的覆盖性决定需要本人确认,并自动写进论文的AI 披露说明。
为什么必须这么严?看三组数据
- 对 arXiv、bioRxiv 等库250 万篇论文的审计估计,仅 2025 年就有14.6 万条AI 幻觉引用;
- ARS 团队自己的压测中,引用错误率一度高达31%;
- 其中21 条问题引用连续骗过3 轮一致性检查。
第 3 条最扎心:检查流程本身也会被蒙混过去,所以任何单道防线都不够看。
AI 越界的三种翻车现场
🧪方法论虚构——Methods 章节用训练数据里"合理"的流程拼出来,跟你真实做过的实验毫无关系。
📚隐式知识泄漏——空白处被记忆里的过时内容、错误内容悄悄填满。
📄无意抄袭——训练数据里的段落被逐字复现到正文中。
三种翻车的共同点只有一个:不对照原始材料,你根本发现不了。
四种校验关卡:ARS 怎么层层核对引用
ARS 从不依赖单点防御,围绕参考文献的真实性,整条流水线布了四道关卡。
关卡一:引用存在性校验,确定性脚本不经手 AI
v3.11 起,每一条被引用的文献都会被自动交叉核对4 个学术索引(Semantic Scholar、OpenAlex、Crossref、arXiv)。DOI 或 arXiv ID 查无实据,直接判定"不存在"——这一步是纯程序化的,编出来的 DOI 过不去这一关。脚本位于 scripts/verify_passport.py 与 scripts/verification_gate/。
关卡二:Stage 2.5 / 4.5 一致性门禁 + 7 种失败模式清单
初稿与终稿各要过一道不可跳过的一致性检查,审查代理必须逐一排除7 种 AI 研究失败模式(Mode 2 即引用幻觉,Mode 6 即方法论虚构)。任何一项被标"疑似",流水线当场暂停,等你处理。清单全文见 ai_research_failure_modes.md。
关卡三:Phase E 论点-来源对齐,引用存在但用对了没
真实文献也可能被错用——拿它去撑它根本没说的结论。Phase E 阶段会抽取文中的关键声明(数字、因果判断、趋势描述)逐条回原文比对:高影响声明 100% 验证,其余按比例抽检;判定分五档(VERIFIED / 轻微偏差 / 重大扭曲 / 无法验证等),出现任何"重大扭曲"或"无法验证",一致性报告直接判 FAIL。协议细节见 claim_verification_protocol.md。
关卡四:数据访问分级,"答案"不能流进"答题者"
每个技能都在元数据中声明自己的数据访问级别(raw/redacted/verified_only),未验证的原始材料与已验证材料严格分层流动,"答案"永远不会漏进"答题者"的上下文。设计原理见 ground_truth_isolation_pattern.md。
3 步安装跑通:从 0 到写作阶段自动激活协议
- 装插件(前提是已装 Claude Code),在 Claude Code 中执行:
/plugin marketplace add Imbad0202/academic-research-skills /plugin install academic-research-skills- 一句话启动流水线:直接说"我要写一篇关于 X 的研究论文",它会按 研究 → 写作 → 评审 → 修订 的顺序推进;简报 + 综述报告 + 带注释参考文献表给足之后,写作阶段的防泄漏协议自动激活。
- 响应标记:看到
[MATERIAL GAP]就补材料,看到[LLM-SUPPLEMENTED]就重点复核那一段。
文件导航:跑通之前先看这几处
| 文件 | 作用 |
|---|---|
| academic-paper/references/anti_leakage_protocol.md | 防泄漏协议全文,核心必读 |
| academic-pipeline/references/ai_research_failure_modes.md | 7 种 AI 研究失败模式清单 |
| academic-pipeline/references/claim_verification_protocol.md | Phase E 论点验证协议 |
| shared/ground_truth_isolation_pattern.md | 数据分层隔离设计 |
| docs/RISK_REGISTER.md | 风险 → 控制措施 → 证据状态对照表 |
| academic-paper/SKILL.md | 写作技能总纲(含协议引用) |
收尾
"不许编"在这里不是一句口号,而是一组可执行机制:写作时的知识隔离、缺口的显式留痕、多索引的确定性校验,再加人工门禁兜底。它不替你写论文,但能让你论文里的每条引用、每段 Methods 都经得起对照原始材料的检验。
【免费下载链接】academic-research-skillsAcademic Research Skills for Claude Code: research → write → review → revise → finalize项目地址: https://gitcode.com/GitHub_Trending/ac/academic-research-skills
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考