茉莉花:中文文献元数据补齐的 3 个修复场景与 5 步安装
【免费下载链接】jasminumA Zotero add-on to retrive CNKI meta data. 一个简单的Zotero 插件,用于识别中文元数据项目地址: https://gitcode.com/gh_mirrors/ja/jasminum
茉莉花是面向中文文献处理的 Zotero 插件,核心是元数据补齐:把知网元数据写回空条目、把缺的 PDF 从下载目录自动认领、给长文档补章节大纲。如果你的 Zotero 里堆着只剩文件名的条目、或者翻不到目录的 PDF,逐篇手填的活可以省掉。
能力一览:4 个中文文献痛点入口
| 能力 | 解决什么 | 省下的成本 |
|---|---|---|
| 知网元数据抓取 | 条目字段全空 | 约 1 小时手填 |
| 本地附件匹配 | 附件存不下来 | 逐条翻下载目录 |
| 中文 PDF 大纲 | 长文档没书签 | 逐页翻找章节 |
| 姓名拆分合并、引用数更新 | 姓名错位、缺引用数 | 逐条改条目框 |
5 步装好:从克隆源码到验证成功
第 1 步 准备环境:需要 Zotero 9.0.3 及以上版本,构建插件另外需要 Node.js 环境。
第 2 步 克隆源码:在终端执行:
git clone https://gitcode.com/gh_mirrors/ja/jasminum第 3 步 构建插件:进入项目目录安装依赖并构建:
npm install npm run build产物是build/目录下的.xpi文件。
第 4 步 装入 Zotero:打开工具 → 插件,点右上角齿轮选从文件安装插件,选中.xpi后重启 Zotero。
第 5 步 确认装好了:拖一个知网 PDF 进 Zotero,右键附件能看到茉莉花抓取子菜单,执行抓取期刊元数据弹出匹配窗口,即安装成功。
把空白的知网条目一次补齐
痛点:知网下载的 PDF 拖进 Zotero,条目只剩文件名,作者、期刊、年份、摘要全部空缺。
做法:
- 把知网 PDF 拖入 Zotero 生成附件
- 右键附件,选
茉莉花抓取 → 抓取期刊元数据 - 在匹配窗口核对候选的来源、期刊与日期
- 点击确认,作者、摘要等字段一次写入
结果:20 篇论文逐篇手工填约 1 小时;在窗口里逐个确认候选,约 3 分钟完成。
边界:
- 文件名没带标题时,可从 PDF 正文提取标题再检索
- 多选附件批量执行,每个附件独立任务
- 匹配窗口无候选时先查网络再重试
📥 让缺失的 PDF 自动归位
痛点:用 Connector 抓中文期刊时题录存下了、附件存不下来,PDF 躺在下载目录里对不上条目。
做法:
- 把手动下载的 PDF 放进下载目录
- 右键期刊条目,选
小工具 → 在下载文件夹中查找附件 - 按条目标题与文件名相似度自动比对,最匹配的附件直接导入
结果:每条只需一次右键;右键整个合集可批量扫描分类下所有缺附件的条目,导入后原文件默认备份到下载目录/jasminum-backup。
边界:
- 下载目录默认系统下载目录,可在设置中改
- 匹配只看条目标题与文件名,命名离谱易漏配
- 原文件可设为删除或保持不动
📑 给没有书签的中文 PDF 补一本目录
痛点:学位论文这类长中文 PDF 没有书签,阅读器里想到第四章只能逐页翻。
做法:
- 在 Zotero 阅读器中打开该 PDF
- 点左侧边栏的茉莉花书签按钮,打开大纲窗口
- 用顶部
添加书签按钮逐级建章节节点 - 建好后用方向键导航
结果:建好目录后 ↑ / ↓ 直达任意章节,百页论文不用翻页找位置。
| 按键 | 作用 |
|---|---|
| ↑ / ↓ | 上一个 / 下一个书签 |
| ← / → | 折叠 / 展开当前节点 |
| 空格 | 编辑书签文字 |
| \ | 新建子节点 |
| Delete | 删除当前节点 |
边界:
- 默认只存本地配置文件,原 PDF 不受影响
- 点
将大纲保存到 PDF才写入文件本身 - 节点带子节点时删除会级联整棵子树
进阶调优:3 个值得动的设置
文件名解析模板:默认{%t}_{%g}(标题_作者)→ 下载文件名规律不一致时改 → 选标题或自定义模板,{%t}标题、{%g}作者、{%y}年份、{%j}其他。
元数据抓取来源:默认知网、万方、中华医学期刊一起查 → 只用一个库或某源常超时 → 在设置里只勾选需要的来源,出现完全匹配会自动跳过后续源。
附件下载目录与匹配阈值:目录默认系统下载目录、阈值默认 0.8 → 漏配多就调低到 0.7 左右,配错就调高 → 目录指向浏览器真实下载位置。
高频疑问:会改原 PDF 吗?
PDF 大纲会改动原文件吗?不会。大纲默认以本地配置文件形式保存;只有点将大纲保存到 PDF才写入文件本身。
附件匹配只支持期刊条目吗?不是。期刊、学位论文、会议论文都适用,右键合集可批量扫描分类下所有缺附件的条目。
PDF 文件名有硬性要求吗?没有。默认模板能解析大多数知网文件名;命名实在不规范时,插件会从 PDF 正文提取标题再检索。
抓取不出候选怎么办?先检查网络;再在设置里多开万方等来源,插件按优先级依次检索。
从第 1 个场景开始
上面 5 步装好、3 个场景修好三类缺口。先拿 3 个知网 PDF 跑一遍第一个场景,匹配窗口弹出并确认候选后,元数据会自动写入条目。
【免费下载链接】jasminumA Zotero add-on to retrive CNKI meta data. 一个简单的Zotero 插件,用于识别中文元数据项目地址: https://gitcode.com/gh_mirrors/ja/jasminum
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考