☰
Wenyi支持格式全解析:EPUB、PDF、DOCX、SRT等7类输入格式实测对比
2026/10/1 12:44:37 网站建设 项目流程

Wenyi支持格式全解析:EPUB、PDF、DOCX、SRT等7类输入格式实测对比

【免费下载链接】wenyi将被语言阻隔的作品,带到读者的语言中。Bringing literature into your language.项目地址: https://gitcode.com/BigDawnGhost/wenyi

Wenyi 是一款面向长篇书籍与长篇写作的 AI 翻译工具,支持EPUB、FB2、TXT、Markdown、HTML、PDF、DOCX、SRT等输入格式,一条命令即可完成整书解析、全书预扫描、分批翻译与成品导出,是新手做电子书翻译、字幕翻译的首选工具。

本文把 Wenyi 的 8 种输入格式按 7 大场景逐一拆解:每种格式走哪条流水线、保留哪些排版、有哪些隐藏限制,帮你选对格式、少走弯路。

7 大输入格式速览:一张表看懂

输入格式典型场景流水线排版保留能力一句话点评
EPUB网络小说、出版电子书完整书籍流水线★★★★★ 回填原模板首选格式,保留样式/目录/锚点
TXT / Markdown纯文本稿完整书籍流水线★★★☆☆ 标题层级识别 ATX 标题自动分章
FB2FB2 阅读器书籍完整书籍流水线★★★☆☆ 重建 EPUB支持诗节、题记、引用
HTML单文件网页书籍完整书籍流水线★★★☆☆适合博客导出的书
PDF扫描件、排版 PDF完整书籍流水线(实验性)★★☆☆☆ 依赖后端需 MinerU 或 BabelDOC
DOCXWord 书稿完整书籍流水线★★★★☆ 样式回填中文输出自动用宋体
SRT电影/剧集字幕轻量并发路径保留时间轴无术语表、无全书审校

💡 书籍类格式共享同一套「全书理解 → 分批翻译 → 润色 → 审校 → 导出」流水线;SRT 字幕则走专门的轻量路径,速度快但功能精简。

EPUB:排版保留最完整的明星格式

EPUB 是 Wenyi 的"主场"。解析器会读取书籍的 OPF 元数据、Spine 正文资源和目录(TOC),按目录锚点切分逻辑章节(源码见 ingest/epub_reader.py)。

它的杀手锏是原生回填:翻译后的文字直接写回原始 XHTML 模板,样式、图片、目录、锚点全部保留,竖排书籍还会自动转为横排以便中文阅读。断点续传同样完美——中断后重跑同一条命令即可继续。

uv run wenyi translate book.epub

这是文档中反复出现的核心命令,默认输出output/book.zh.epub。

TXT 与 Markdown:纯文本也能自动分章

纯文本读者常担心"没有结构怎么分章"。Wenyi 的文本解析器(ingest/text_reader.py)有三重保险:

  • Markdown ATX 标题(#、##、###)优先识别,并保留层级信息用于导出;
  • 日语章节标记(第一章、序章、エピローグ等)识别为一级标题;
  • 都没有标题时,整本书作为一章处理,空行分段。

对新手来说,把网络小说导出为.md或.txt就能直接开翻,标题会自动参与翻译并回填。

FB2 与 HTML:小众格式也有完整支持

FB2(FictionBook)是 XML 电子书格式,常见于 FB2 阅读设备。Wenyi 支持 2.0/2.1 及无命名空间版本,能递归展平嵌套章节,完整保留题记、引用、诗节/诗行与图片引用(ingest/fb2_reader.py)。注意:FB2 没有回填锚点,翻译完成后会生成一本新的 EPUB。

HTML 输入走同一套书籍流水线,适合单文件网页书或从博客导出的长文。

PDF:实验性支持,两条后端路线

PDF 是限制最多的格式(官方标注为实验性),但 Wenyi 给了两条清晰的路线:

  • MinerU(默认):首次转换需要MINERU_API_KEY。PDF 转成的 HTML 会按文件哈希缓存到state/<book>/targets/<target-language>/source/<SHA-256>/converted.html——你可以手动校对这份 HTML 再续跑,转换只做一次(ingest/pdf_reader.py)。
  • BabelDOC 桥(可选):面向需要保留原版的排版级 PDF,通过外部 HTTP 桥服务回填 PDF;遇到纯扫描、无文字层的页面时会主动停下,建议改用 MinerU 或先做 OCR。

⚠️ 新手建议:PDF 排版越复杂、扫描质量越差,效果越依赖后端能力,重要书稿优先考虑从 EPUB/TXT 起步。

DOCX:Word 书稿的样式守护者

Word 文档走完整书籍流水线(术语表、润色、审校、续传一应俱全)。解析器(ingest/docx_reader.py)会:

  • 按 1–9 级标题(Heading 1–9/ outlineLvl)切章,一级标题开启新章;
  • 逐格重建简单表格(v1 暂不支持合并单元格/嵌套表);
  • 保留加粗、斜体、下划线、颜色、字号、对齐与底纹;
  • 翻译后的中文统一使用宋体;含手动编号前缀的目录行不会二次编号。
uv run wenyi translate book.docx --bilingual # 输出 .zh.docx,可加双语文本版

SRT 字幕:轻量并发路径,快而不重

.srt文件会被translate命令自动识别并路由到字幕专用路径(ingest/srt_reader.py):

  • 20 条提示的滑动窗口、10 条重叠,最多 100 路强模型并发;
  • 没有术语表、润色和全书审校,因此速度极快;
  • 编码宽容:自动尝试 UTF-8 / GB18030 / UTF-16 等,老字幕文件也不容易乱码;
  • 默认输出output/<文件名>.zh.srt,加--bilingual再出一版.zh-bi.srt双语字幕。

输出格式:一次翻译,多种交付

书籍输入可用--format在epub / txt / html / markdown / pdf / docx之间任选;PDF 默认跟随当初使用的转换后端。双语版(--bilingual)会将原文以视觉弱化样式与译文并排呈现,支持暗色模式。

在 Web 工作台中,翻译进度、各阶段 Token 用量与运行时长一目了然,译完还能逐段对照校对:

新手选型建议:3 个问题定格式

  1. 书从哪来?正规电子书 → 直接用 EPUB;Word 稿 → 直接用 DOCX;只有 PDF → 走 MinerU 后端,接受实验性结果。
  2. 要不要双语版?加--bilingual,书籍和字幕都支持,适合对照阅读。
  3. 长文还是字幕?长文走完整流水线(术语一致 + 全书审校);剧集中文字幕用 SRT 轻量路径,几分钟就能跑完。

关键文档与源码路径

  • 使用指南(各格式细节):docs/usage.md
  • 中文使用指南:docs/zh/usage.md
  • 配置说明(语言、流水线开关):docs/configuration.md
  • 流水线原理:docs/pipeline.md
  • 格式解析源码目录:ingest/
  • 各格式导出器:assemble/

📌 小结:EPUB 保留排版最完整、SRT 速度最快、PDF 需接受实验性限制。选对输入格式,Wenyi 的整书翻译体验会顺一大截。

【免费下载链接】wenyi将被语言阻隔的作品,带到读者的语言中。Bringing literature into your language.项目地址: https://gitcode.com/BigDawnGhost/wenyi

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

需要专业的网站建设服务?

联系我们获取免费的网站建设咨询和方案报价,让我们帮助您实现业务目标

立即咨询