茉莉花:中文文献元数据补齐的 3 个修复场景与 5 步安装
2026/9/21 18:32:37 网站建设 项目流程

茉莉花:中文文献元数据补齐的 3 个修复场景与 5 步安装

【免费下载链接】jasminumA Zotero add-on to retrive CNKI meta data. 一个简单的Zotero 插件,用于识别中文元数据项目地址: https://gitcode.com/gh_mirrors/ja/jasminum

茉莉花是面向中文文献处理的 Zotero 插件,核心是元数据补齐:把知网元数据写回空条目、把缺的 PDF 从下载目录自动认领、给长文档补章节大纲。如果你的 Zotero 里堆着只剩文件名的条目、或者翻不到目录的 PDF,逐篇手填的活可以省掉。

能力一览:4 个中文文献痛点入口

能力解决什么省下的成本
知网元数据抓取条目字段全空约 1 小时手填
本地附件匹配附件存不下来逐条翻下载目录
中文 PDF 大纲长文档没书签逐页翻找章节
姓名拆分合并、引用数更新姓名错位、缺引用数逐条改条目框

5 步装好:从克隆源码到验证成功

第 1 步 准备环境:需要 Zotero 9.0.3 及以上版本,构建插件另外需要 Node.js 环境。

第 2 步 克隆源码:在终端执行:

git clone https://gitcode.com/gh_mirrors/ja/jasminum

第 3 步 构建插件:进入项目目录安装依赖并构建:

npm install npm run build

产物是build/目录下的.xpi文件。

第 4 步 装入 Zotero:打开工具 → 插件,点右上角齿轮选从文件安装插件,选中.xpi后重启 Zotero。

第 5 步 确认装好了:拖一个知网 PDF 进 Zotero,右键附件能看到茉莉花抓取子菜单,执行抓取期刊元数据弹出匹配窗口,即安装成功。

把空白的知网条目一次补齐

痛点:知网下载的 PDF 拖进 Zotero,条目只剩文件名,作者、期刊、年份、摘要全部空缺。

做法:

  1. 把知网 PDF 拖入 Zotero 生成附件
  2. 右键附件,选茉莉花抓取 → 抓取期刊元数据
  3. 在匹配窗口核对候选的来源、期刊与日期
  4. 点击确认,作者、摘要等字段一次写入

结果:20 篇论文逐篇手工填约 1 小时;在窗口里逐个确认候选,约 3 分钟完成。

边界:

  • 文件名没带标题时,可从 PDF 正文提取标题再检索
  • 多选附件批量执行,每个附件独立任务
  • 匹配窗口无候选时先查网络再重试

📥 让缺失的 PDF 自动归位

痛点:用 Connector 抓中文期刊时题录存下了、附件存不下来,PDF 躺在下载目录里对不上条目。

做法:

  1. 把手动下载的 PDF 放进下载目录
  2. 右键期刊条目,选小工具 → 在下载文件夹中查找附件
  3. 按条目标题与文件名相似度自动比对,最匹配的附件直接导入

结果:每条只需一次右键;右键整个合集可批量扫描分类下所有缺附件的条目,导入后原文件默认备份到下载目录/jasminum-backup

边界:

  • 下载目录默认系统下载目录,可在设置中改
  • 匹配只看条目标题与文件名,命名离谱易漏配
  • 原文件可设为删除或保持不动

📑 给没有书签的中文 PDF 补一本目录

痛点:学位论文这类长中文 PDF 没有书签,阅读器里想到第四章只能逐页翻。

做法:

  1. 在 Zotero 阅读器中打开该 PDF
  2. 点左侧边栏的茉莉花书签按钮,打开大纲窗口
  3. 用顶部添加书签按钮逐级建章节节点
  4. 建好后用方向键导航

结果:建好目录后 ↑ / ↓ 直达任意章节,百页论文不用翻页找位置。

按键作用
↑ / ↓上一个 / 下一个书签
← / →折叠 / 展开当前节点
空格编辑书签文字
\新建子节点
Delete删除当前节点

边界:

  • 默认只存本地配置文件,原 PDF 不受影响
  • 将大纲保存到 PDF才写入文件本身
  • 节点带子节点时删除会级联整棵子树

进阶调优:3 个值得动的设置

文件名解析模板:默认{%t}_{%g}(标题_作者)→ 下载文件名规律不一致时改 → 选标题或自定义模板,{%t}标题、{%g}作者、{%y}年份、{%j}其他。

元数据抓取来源:默认知网、万方、中华医学期刊一起查 → 只用一个库或某源常超时 → 在设置里只勾选需要的来源,出现完全匹配会自动跳过后续源。

附件下载目录与匹配阈值:目录默认系统下载目录、阈值默认 0.8 → 漏配多就调低到 0.7 左右,配错就调高 → 目录指向浏览器真实下载位置。

高频疑问:会改原 PDF 吗?

PDF 大纲会改动原文件吗?不会。大纲默认以本地配置文件形式保存;只有点将大纲保存到 PDF才写入文件本身。

附件匹配只支持期刊条目吗?不是。期刊、学位论文、会议论文都适用,右键合集可批量扫描分类下所有缺附件的条目。

PDF 文件名有硬性要求吗?没有。默认模板能解析大多数知网文件名;命名实在不规范时,插件会从 PDF 正文提取标题再检索。

抓取不出候选怎么办?先检查网络;再在设置里多开万方等来源,插件按优先级依次检索。

从第 1 个场景开始

上面 5 步装好、3 个场景修好三类缺口。先拿 3 个知网 PDF 跑一遍第一个场景,匹配窗口弹出并确认候选后,元数据会自动写入条目。

【免费下载链接】jasminumA Zotero add-on to retrive CNKI meta data. 一个简单的Zotero 插件,用于识别中文元数据项目地址: https://gitcode.com/gh_mirrors/ja/jasminum

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

需要专业的网站建设服务?

联系我们获取免费的网站建设咨询和方案报价,让我们帮助您实现业务目标

立即咨询