Wenyi支持格式全解析:EPUB、PDF、DOCX、SRT等7类输入格式实测对比
【免费下载链接】wenyi将被语言阻隔的作品,带到读者的语言中。Bringing literature into your language.项目地址: https://gitcode.com/BigDawnGhost/wenyi
Wenyi 是一款面向长篇书籍与长篇写作的 AI 翻译工具,支持EPUB、FB2、TXT、Markdown、HTML、PDF、DOCX、SRT等输入格式,一条命令即可完成整书解析、全书预扫描、分批翻译与成品导出,是新手做电子书翻译、字幕翻译的首选工具。
本文把 Wenyi 的 8 种输入格式按 7 大场景逐一拆解:每种格式走哪条流水线、保留哪些排版、有哪些隐藏限制,帮你选对格式、少走弯路。
7 大输入格式速览:一张表看懂
| 输入格式 | 典型场景 | 流水线 | 排版保留能力 | 一句话点评 |
|---|---|---|---|---|
| EPUB | 网络小说、出版电子书 | 完整书籍流水线 | ★★★★★ 回填原模板 | 首选格式,保留样式/目录/锚点 |
| TXT / Markdown | 纯文本稿 | 完整书籍流水线 | ★★★☆☆ 标题层级 | 识别 ATX 标题自动分章 |
| FB2 | FB2 阅读器书籍 | 完整书籍流水线 | ★★★☆☆ 重建 EPUB | 支持诗节、题记、引用 |
| HTML | 单文件网页书籍 | 完整书籍流水线 | ★★★☆☆ | 适合博客导出的书 |
| 扫描件、排版 PDF | 完整书籍流水线(实验性) | ★★☆☆☆ 依赖后端 | 需 MinerU 或 BabelDOC | |
| DOCX | Word 书稿 | 完整书籍流水线 | ★★★★☆ 样式回填 | 中文输出自动用宋体 |
| SRT | 电影/剧集字幕 | 轻量并发路径 | 保留时间轴 | 无术语表、无全书审校 |
💡 书籍类格式共享同一套「全书理解 → 分批翻译 → 润色 → 审校 → 导出」流水线;SRT 字幕则走专门的轻量路径,速度快但功能精简。
EPUB:排版保留最完整的明星格式
EPUB 是 Wenyi 的"主场"。解析器会读取书籍的 OPF 元数据、Spine 正文资源和目录(TOC),按目录锚点切分逻辑章节(源码见 ingest/epub_reader.py)。
它的杀手锏是原生回填:翻译后的文字直接写回原始 XHTML 模板,样式、图片、目录、锚点全部保留,竖排书籍还会自动转为横排以便中文阅读。断点续传同样完美——中断后重跑同一条命令即可继续。
uv run wenyi translate book.epub这是文档中反复出现的核心命令,默认输出output/book.zh.epub。
TXT 与 Markdown:纯文本也能自动分章
纯文本读者常担心"没有结构怎么分章"。Wenyi 的文本解析器(ingest/text_reader.py)有三重保险:
- Markdown ATX 标题(
#、##、###)优先识别,并保留层级信息用于导出; - 日语章节标记(第一章、序章、エピローグ等)识别为一级标题;
- 都没有标题时,整本书作为一章处理,空行分段。
对新手来说,把网络小说导出为.md或.txt就能直接开翻,标题会自动参与翻译并回填。
FB2 与 HTML:小众格式也有完整支持
FB2(FictionBook)是 XML 电子书格式,常见于 FB2 阅读设备。Wenyi 支持 2.0/2.1 及无命名空间版本,能递归展平嵌套章节,完整保留题记、引用、诗节/诗行与图片引用(ingest/fb2_reader.py)。注意:FB2 没有回填锚点,翻译完成后会生成一本新的 EPUB。
HTML 输入走同一套书籍流水线,适合单文件网页书或从博客导出的长文。
PDF:实验性支持,两条后端路线
PDF 是限制最多的格式(官方标注为实验性),但 Wenyi 给了两条清晰的路线:
- MinerU(默认):首次转换需要
MINERU_API_KEY。PDF 转成的 HTML 会按文件哈希缓存到state/<book>/targets/<target-language>/source/<SHA-256>/converted.html——你可以手动校对这份 HTML 再续跑,转换只做一次(ingest/pdf_reader.py)。 - BabelDOC 桥(可选):面向需要保留原版的排版级 PDF,通过外部 HTTP 桥服务回填 PDF;遇到纯扫描、无文字层的页面时会主动停下,建议改用 MinerU 或先做 OCR。
⚠️ 新手建议:PDF 排版越复杂、扫描质量越差,效果越依赖后端能力,重要书稿优先考虑从 EPUB/TXT 起步。
DOCX:Word 书稿的样式守护者
Word 文档走完整书籍流水线(术语表、润色、审校、续传一应俱全)。解析器(ingest/docx_reader.py)会:
- 按 1–9 级标题(
Heading 1–9/ outlineLvl)切章,一级标题开启新章; - 逐格重建简单表格(v1 暂不支持合并单元格/嵌套表);
- 保留加粗、斜体、下划线、颜色、字号、对齐与底纹;
- 翻译后的中文统一使用宋体;含手动编号前缀的目录行不会二次编号。
uv run wenyi translate book.docx --bilingual # 输出 .zh.docx,可加双语文本版SRT 字幕:轻量并发路径,快而不重
.srt文件会被translate命令自动识别并路由到字幕专用路径(ingest/srt_reader.py):
- 20 条提示的滑动窗口、10 条重叠,最多 100 路强模型并发;
- 没有术语表、润色和全书审校,因此速度极快;
- 编码宽容:自动尝试 UTF-8 / GB18030 / UTF-16 等,老字幕文件也不容易乱码;
- 默认输出
output/<文件名>.zh.srt,加--bilingual再出一版.zh-bi.srt双语字幕。
输出格式:一次翻译,多种交付
书籍输入可用--format在epub / txt / html / markdown / pdf / docx之间任选;PDF 默认跟随当初使用的转换后端。双语版(--bilingual)会将原文以视觉弱化样式与译文并排呈现,支持暗色模式。
在 Web 工作台中,翻译进度、各阶段 Token 用量与运行时长一目了然,译完还能逐段对照校对:
新手选型建议:3 个问题定格式
- 书从哪来?正规电子书 → 直接用 EPUB;Word 稿 → 直接用 DOCX;只有 PDF → 走 MinerU 后端,接受实验性结果。
- 要不要双语版?加
--bilingual,书籍和字幕都支持,适合对照阅读。 - 长文还是字幕?长文走完整流水线(术语一致 + 全书审校);剧集中文字幕用 SRT 轻量路径,几分钟就能跑完。
关键文档与源码路径
- 使用指南(各格式细节):docs/usage.md
- 中文使用指南:docs/zh/usage.md
- 配置说明(语言、流水线开关):docs/configuration.md
- 流水线原理:docs/pipeline.md
- 格式解析源码目录:ingest/
- 各格式导出器:assemble/
📌 小结:EPUB 保留排版最完整、SRT 速度最快、PDF 需接受实验性限制。选对输入格式,Wenyi 的整书翻译体验会顺一大截。
【免费下载链接】wenyi将被语言阻隔的作品,带到读者的语言中。Bringing literature into your language.项目地址: https://gitcode.com/BigDawnGhost/wenyi
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考