ARTICLE DETAIL

资讯详情

深耕郑州网站建设与运营推广的一线实战洞察。

AI图书翻译终极指南:如何用translate-book并行翻译一整本书(PDF/EPUB/DOCX转中文)

AI图书翻译终极指南:如何用translate-book并行翻译一整本书(PDF/EPUB/DOCX转中文) AI图书翻译终极指南如何用translate-book并行翻译一整本书PDF/EPUB/DOCX转中文【免费下载链接】translate-bookAgent skill for Codex, Claude Code, and OpenClaw that translates entire books (PDF/DOCX/EPUB) into any language using parallel subagents.项目地址: https://gitcode.com/gh_mirrors/tran/translate-book用 AI 翻译整本书你是不是也遇到过这些问题上下文太长被截断、人名前后译法不一致、翻到一半中断只能从头再来translate-book就是为解决这些痛点而生的开源 AI 图书翻译工具它是一个面向 Codex、Claude Code、OpenClaw 的 Agent Skill把整本 PDF / DOCX / EPUB 拆块后交给 8 个并行子代理同时翻译自动校验并合并成完整中文译本一次产出 HTML、DOCX、EPUB、PDF 四种格式。为什么普通 AI 翻译整本书容易翻崩直接让大模型一口气读完一本书再翻译通常有三个致命问题痛点原因输出被截断上下文窗口塞满后译文在几万字处戛然而止术语漂移同一个专有名词第 1 章译曼哈顿、第 40 章译曼哈敦中断不可恢复断网、限流一次几百块的 token 全部白烧translate-book 的思路是**分而治之**每块只交给一个拥有全新上下文窗口的子代理翻译再靠术语表和哈希校验把 100 个块缝回一本术语一致、完整无缺的书。一分钟上手安装与前置要求安装前确认本机已装好三样东西Calibreebook-convert命令可用、Pandoc、Python 3pip install pypandoc。在对应 Agent 中执行一条命令即可装好 Skill # Claude Code npx skills add deusyu/translate-book -a claude-code -g # Codex npx skills add deusyu/translate-book -a codex -g # OpenClaw openclaw skills install deusyu/translate-book如果 npx 方式不便也可以直接克隆仓库手动安装git clone https://gitcode.com/gh_mirrors/tran/translate-book ~/.claude/skills/translate-book三步翻译一本书从 PDF 到中文 EPUB第 1 步把书交给 Agent装好 Skill 后直接用自然语言下命令即可例如在 Claude Code 中translate /path/to/book.pdf to ChineseCodex 中也可以用$translate-book Translate /path/to/book.pdf into Chinese.。Skill 会自动跑完整个流水线格式转换 → 拆块 → 并行翻译 → 校验 → 合并 → 构建全程无需人工干预。第 2 步等待并行翻译完成每批默认8 路子代理并发各自独立翻译一个约 6000 字符的块。翻译过程中如果中断重新运行即可从断点续跑已完成的块不会重复消耗 token。第 3 步一次拿到 4 种格式翻译完成后所有成品都在书名对应的{book_name}_temp/目录下文件说明output.md合并后的完整译文 Markdownbook.html网页版带浮动目录适合在线阅读book.docxWord 文档方便二次编辑book.epub电子书可导入各类阅读 Appbook.pdf可打印 PDF 成品书幕后揭秘四个环节保证译本质量这张海报里的 4 个步骤正是整条流水线的核心转换切块—— Calibre 把 PDF/DOCX/EPUB 统一转为 Markdown再按约 6000 字符一块切开scripts/convert.py 会为每块记录 SHA-256 指纹后续任何过时块都会被拦截。并行翻译—— 翻译前先抽样全书章节建立术语表glossary.json翻译时每块都会注入专属的原文 | 别名 | 译文对照表作为硬性约束由 scripts/glossary.py 管理专治人名、地名千人千译。校验续跑—— 合并前逐块做哈希比对、1:1 源↔输出匹配检查空白块、损坏块一律拒绝合并scripts/run_state.py 记录每块用了哪版术语表修改术语后只重译受影响的块而不是全书重来。合并成书—— scripts/merge_and_build.py 把全部译文合并为output.md再经 Pandoc Calibre 生成带目录的 HTML、DOCX、EPUB、PDF。每个环节的完整编排规则写在 SKILL.md 中想看细节可以直接翻它。常见问题快速排坑症状解决办法提示找不到ebook-convert安装 Calibre 并确保其在 PATH 中Manifest validation failed源文件被改过重跑 scripts/convert.py 重新拆块翻译不完整直接重跑 Skill它会从断点继续改标题/模板后成品没更新删除 temp 目录里的output.md、book.*再重跑构建学术 PDF 公式、表格错乱先用 MinerU 或 Marker 解析成 Markdown再喂给convert.py更完整的排查表见 README.zh-CN.md 的常见问题一节。 项目文件导航中文文档README.zh-CN.mdSkill 定义流水线编排核心SKILL.md脚本目录scripts/含格式转换、术语表、断点续跑、合并构建等全部工具完整链路测试基线可直接拿来练手的小书tests/baselines/里面自带《爱丽丝漫游奇境》《沉睡的谷》等公开领域书籍的 EPUB从翻崩到成书你只需要一条自然语言命令——拆块、并行、校验、合并这些脏活累活都交给 translate-book 的流水线吧。【免费下载链接】translate-bookAgent skill for Codex, Claude Code, and OpenClaw that translates entire books (PDF/DOCX/EPUB) into any language using parallel subagents.项目地址: https://gitcode.com/gh_mirrors/tran/translate-book创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表