ARTICLE DETAIL

资讯详情

深耕郑州网站建设与运营推广的一线实战洞察。

如何把电子书转成有声书:ebook2audiobook 上手完整教程

如何把电子书转成有声书:ebook2audiobook 上手完整教程 如何把电子书转成有声书ebook2audiobook 上手完整教程【免费下载链接】ebook2audiobookGenerate audiobooks from e-books, voice cloning 1158 languages!项目地址: https://gitcode.com/GitHub_Trending/eb/ebook2audiobook想通勤路上听完手里这本 EPUB 时你不需要自己录音。ebook2audiobook 是一个电子书转有声书工具它自动解析电子书的文字与章节再用 TTS 引擎合成音频文件适合想把读变成听的任何人。一分钟看懂它的流程分三步。输入你在网页里丢进一本电子书EPUB、MOBI、PDF、TXT 等 20 余种格式都行扫描版 PDF 也能通过内置 OCR 识别出文字。处理程序先抽取文本、检测章节结构再把长文切成适合合成的段落如果你上传了一段自己的录音还会对这段语音做克隆并用它来朗读整本书。输出分段音频被拼接成完整文件带章节信息直接在页面里试听或下载到本地播放器。 能力清单语言与语音1158 种语言从中文、英文到较冷门的小语种都能选选语言后会自动匹配兼容的引擎语音克隆上传 1~5 分钟的录音即可自带背景噪声的录音也会被自动清理8 种 TTS 引擎XTTSv2、Bark、VITS、YourTTS 等按音质与速度需求切换SML 控制标签文本里写[break]、[pause:3]控制停顿用[voice:...]中途换声音格式兼容20 种输入格式.epub、.mobi、.azw3、.pdf、.txt、.html 等其中 EPUB 和 MOBI 的章节检测效果最好10 种输出格式m4b、m4a、mp3、flac、wav、ogg 等默认单声道 m4b批量转换headless 模式下传一个文件夹路径一次转完里面所有电子书硬件门槛低配置可跑最低 2GB 内存 / 1GB 显存推荐 8GB / 4GB跨平台Windows、macOS含 Apple Silicon、Linux 均有启动脚本Docker 可用官方镜像自包含依赖支持 headless 模式 上手实操第一步准备克隆仓库并进入目录git clone https://gitcode.com/GitHub_Trending/eb/ebook2audiobook cd ebook2audiobook启动脚本会自动安装缺失的 Python 依赖和系统工具不需要你手动建虚拟环境。第二步首次运行Linux/macOS 在终端执行下面这条命令Windows 直接双击ebook2audiobook.cmd./ebook2audiobook.command终端打印本地地址后浏览器打开http://localhost:7860/进入界面。在 Input Options 页把电子书拖进上传框下拉选择语言不克隆声音就留空语音区处理器按机器情况选 CPU 或 GPU。第三步拿到结果设置完成后点击Convert进度条走完后下方出现结果区先用 Listen 播放器试听几段再从 Audiobooks 下拉框选中文件点 Download 保存。默认输出是单声道m4b存到audiobooks/目录后可导入 Audiobookshelf 播放想换格式或输出目录改 lib/conf.py 里的默认配置即可。⚙️ 参数详解第一次转换不用动任何参数。只有当你觉得声音太机械、同一句话老重复或生成太慢时才需要打开 Audio Generation Preferences 页调这些滑杆参数作用建议值--temperature创造性越高越不可预测越低越平默认 0.65--speed朗读语速默认 1范围 0.5~3--repetition_penalty越高越不容易重复短语默认 2.5--top_k采样候选词数越小生成越快默认 50嫌慢就调小--top_p选词累计概率截断越小越保守默认 0.8--enable_text_splitting长文切段后分块合成超长书籍开启以上滑杆对应 headless 命令行参数XTTS 引擎专用Bark 则用--text_temp和--waveform_temp两个参数。 适用人群与场景如果你通勤时间长可以把下载好的 EPUB 转成有声书一路听完如果你手头只有扫描版 PDF内置 OCR 能先把图片里的字认出来再合成如果你想做播客或旁白克隆自己的声音整本书生成如果你只是想快速测试页面里的文本框可直接输入短文本生成音频试听⚠️ 避坑指南GPU 检测不到→ CUDA/ROCm 版本或驱动不匹配 → 按 README 里 GPU 排查章节检查或先用 CPU 跑通CPU 模式非常慢→ 现代 TTS 引擎在 CPU 上开销大 → 换 GPU或改用 YourTTS、Tacotron2 这类轻量引擎脚本重启后网页连不上→ 浏览器还连着旧会话 → 刷新页面重新连接音频中途截断→ 该语言的句子切分逻辑不完善 → 在仓库 issue 里附上出问题的文本片段帮助修复收尾读完就可以动手克隆仓库、挑一本 EPUB 跑一遍有 GPU 的机器用 XTTS没有的就选轻量引擎第一本有声书今晚就能出声。版本记录在仓库根目录的 VERSION.txt升级前先看一眼。【免费下载链接】ebook2audiobookGenerate audiobooks from e-books, voice cloning 1158 languages!项目地址: https://gitcode.com/GitHub_Trending/eb/ebook2audiobook创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表