
1158 语言 AI 有声书工厂把 Calibre 里的电子书变成音频的实战教程【免费下载链接】ebook2audiobookGenerate audiobooks from e-books, voice cloning 1158 languages!项目地址: https://gitcode.com/GitHub_Trending/eb/ebook2audiobook你的 Calibre 书库里是不是也堆满了 EPUB其中大半却从未被听过ebook2audiobookE2A是一款开源的电子书转语音 AI 语音合成工具丢进一本电子书产出带完整章节和元数据的 AI 有声书支持 1158 种语言和声音克隆。读完这篇你会拿到3 步出第一本可播放有声书的操作路径Windows / macOS / Linux 各自合适的部署方式语音克隆与多语言引擎的挑选方法官方 FAQ 里点名的 4 个坑及解法输入选项界面电子书、声音样本、语言、计算单元一页配齐能力总览先看几组硬数据心里有底再动手语言数 115828 种主流语言 1130 余种小语种20 输入格式epub、mobi、azw3、pdf、txt、rtf、html、docx 等10 种输出格式m4b、mp3、flac、wav、ogg、aac 等单声道或立体声9 个 TTS 引擎XTTSv2、Bark、Fairseq、VITS、Tacotron2、Piper 等声音克隆一段 15 分钟样本即可背景噪音自动清理章节与元数据保留SML 标签可微调停顿与说话人准入门槛2GB 内存 / 1GB 显存即可跑扫描件、纯图片的 PDF 也有内置 OCR 兜底。很多人把它叫 Calibre 有声书插件——严格说它是独立工具不用装进 Calibre从书库导出 EPUB 直接开工。 快速上手3 步出第一本有声书第 1 步拿代码。把仓库克隆到任意目录并进入git clone https://gitcode.com/GitHub_Trending/eb/ebook2audiobook cd ebook2audiobook第 2 步启动。Linux / macOS 执行./ebook2audiobook.commandWindows 双击ebook2audiobook.cmd。首次运行会自动补齐依赖macOS 走 HomebrewWindows 走 scoop不需要管理员权限。第 3 步转换。终端会打印localhost:7860地址浏览器打开把 EPUB 拖进去选语言和声音点转换即可。用 Calibre 管书的话导出 EPUB 丢进来就行。三种部署方式任选同一套代码三种用法按你的场景挑方式适合谁平台要点轻量无头模式脚本党、批量任务命令行加--headless一行指定电子书、语言、声音Linux/macOS 用.commandWindows 用.cmd原生 GUI 模式绝大多数用户双击启动浏览器进 Web 界面Windows 由 scoop 自动装依赖macOS 由 Homebrew 兜底容器化 Docker环境复杂、想干净隔离镜像完全自包含告别依赖折腾Windows 需开启虚拟化Docker 内 Apple Silicon 按 CPU 跑不想占用本机仓库自带 Google Colab 与 Kaggle 笔记本见 Notebooks/远程免费 GPU 上跑完整流程。 进阶玩法声音克隆 × 多语言引擎克隆自己的声音上传一段 15 分钟的音频即可。录音环境吵也没关系E2A 会自动降噪。想更进一步可以用内置的 components/Universal_TTS_Finetune 微调自己的 XTTSv2 模型再以自定义模型加载。引擎怎么选直接抄表目标语言推荐引擎特点中文、英语XTTSv2自然流畅支持零样本声音克隆法语、德语、西语等主流语XTTSv2 / BarkBark 表现力更强情绪起伏足1130 小语种Fairseq覆盖广度是它的看家本领纯 CPU 低配机YourTTS / Tacotron2CPU 友好官方提示音色偏Siri 级完整语言清单见 README.md 的 Supported Languages 一节。转换完成后在线试听并下载 m4b 文件速度与硬件逼近实时怎么做到官方口径CPU 明显偏慢GPU 可以做到接近实时的转换。所以耗时大头不在哪台机器而在算力单元和引擎的搭配硬件档位速度体验推荐引擎基础 CPU2GB 内存慢适合轻量任务YourTTS、Tacotron2中端 GPU1GB 显存起步4GB 更稳快VITS、Fairseq、XTTSv2高端 GPUCUDA / ROCm / XPU接近实时XTTSv2 声音克隆三条调优建议CPU 就换轻引擎——现代引擎在 CPU 上非常慢YourTTS / Tacotron2 是官方点名方案整柜一次转完——无头模式支持--ebooks_dir批量目录转换与多进程转换用 SML 标签精修节奏——[break]、[pause:N]、[voice:...]精确控制停顿与换声改一句不用重转全书Audio Generation Preferences 页用滑块调创造力、语速、重复惩罚故障速查现象怎么办GPU 没被识别核对驱动与计算框架版本按官方 GPU Issues Wiki 自查CPU 转换太慢换低负载引擎或改用 GPU顺带检查参数是否合理手动装依赖反复失败别折腾了Docker 镜像自包含且支持无头模式命令末尾加--help看全部选项音频在句中被截断已知痛点直接提 issue官方正按语言逐步优化断句逻辑输出格式、声道等默认值在 lib/conf.py 里改前建议先备份一份。现在就开始路线图已经排上按句级精确编辑文本、iOS / Android 客户端、接入更多新引擎Audiobookshelf 书库集成也已可用。与其收藏吃灰不如今晚就从 Calibre 书库里导一本 EPUB让 E2A 先读给你听。 顺手收藏这篇项目更新很快新声音、新引擎会持续落地。【免费下载链接】ebook2audiobookGenerate audiobooks from e-books, voice cloning 1158 languages!项目地址: https://gitcode.com/GitHub_Trending/eb/ebook2audiobook创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考