
OpenVoice 语音克隆保姆级教程3 步本地部署用 15 秒音频克隆你的声音【免费下载链接】OpenVoiceInstant voice cloning by MIT and MyShell. Audio foundation model.项目地址: https://gitcode.com/GitHub_Trending/op/OpenVoiceOpenVoice 是一个开源的即时语音克隆工具只要 15 秒参考音频就能用你的音色说出多语言文字MIT 协议可免费商用。它能帮你做什么先看适不适合你给视频、播客配音录一段自己 15 秒的声音之后让任意文字自动变成你的声音读出来不用再逐条重录。给作品做多语言版本用你中文的音色直接读出英语、日语、韩语台词配音不必另请配音员。想上手语音技术但没基础自带一个本地网页填字、传音频、点按钮就能出结果不必先啃代码。下面这张图展示克隆出的声音在一个产品里被使用起来的整体流程。3 步在本地跑起来先建干净的 Python 环境再装能少踩一半的坑。整个安装就下面这几条命令V1 和 V2 完全一样conda create -n openvoice python3.9 conda activate openvoice git clone https://gitcode.com/GitHub_Trending/op/OpenVoice cd OpenVoice pip install -e .前两条建一个叫 openvoice 的 Python 3.9 环境并激活避免弄脏你系统的 Python。第三条把仓库克隆到本地。后两条进入目录并安装依赖。 装好之后终端最后一行会打印 Successfully installed MyShell-OpenVoice-0.0.0说明依赖都到位了可以进入下一步。原理白话版它是怎么换声带的可以把 OpenVoice 理解成一条流水线分两件事做。第一段由基础说话人模型 BaseSpeakerTTS 负责念稿也就是把你要说的内容合成语音口音、情绪、节奏这些风格都由它控制第二段由音色转换器 ToneColorConverter 负责换声带它从你的参考音频里只抽出音色这一个属性贴到刚才那段语音上而语气、停顿、节奏都原样保留。所以你能一边用你的音色一边让它用耳语、生气或欢快的语气说话。核心功能逐个试1打开网页界面填字就能出声音不想写代码时OpenVoice 自带一个本地 Gradio 网页填文本、传一段你的音频、选个风格点 Send 就能听到用你音色读出来的结果。装好依赖后在项目根目录运行python -m openvoice_app --share浏览器会自动打开页面左侧输入框写一句话、上传参考音频并勾选同意右侧就播放克隆好的语音。本地网页 Demo 支持的语言与风格如下源码见 openvoice/openvoice_app.py语言本地网页 Demo 支持的风格英语default、whispering、excited、cheerful、sad、angry、terrified、friendly 等中文目前仅 default2让同一个音色换语气、换情绪音色只克隆音色语气和情绪由基础说话人模型控制所以你能让同一个人一会儿耳语、一会儿生气、一会儿开心。在网页界面 Style 下拉框里选不同风格whispering 耳语、excited 兴奋、sad 悲伤等再点 Send。你会看到出来一段音色没变、但语气明显不同的语音。3跨语言克隆你的声音说外语参考语音和生成语音的语言都不需要在训练集里出现过——这就是零样本跨语言。V2 原生支持英、西、法、中、日、韩六种语言其他语言可换成对应的基础说话人模型再走同一个音色转换器。具体写法参考示例 demo_part2.ipynb你会看到自己中文录音的音色却流利地读出英文或日语台词。⚠️ 踩坑指南现象 → 原因 → 怎么办音色像但口音、情绪对不上。原因是 OpenVoice 只克隆音色不克隆口音和情绪那些由基础说话人模型决定。想换口音或情绪就换带那种风格的基础说话人模型而不是指望转换器去模仿。生成语音有杂音、发闷。常见原因是参考音频有背景噪声、太短、多人说话或有大段空白。换一段 5–15 秒、干净、单人、无长空白的录音采样率 16kHz 以上。跑 VAD 环节卡在 Silero 下载。原因是机器连不上 GitHub自动下载失败。按 docs/QA.md 手动下载 Silero VAD 的 zip 并解压到缓存目录即可。网页 Demo 里输入其他语言报错。原因是本地 Gradio Demo 只支持英语和中文且中文只有 default。其他语言改用 Python API 换对应基础模型或上 V2 用原生六语言。总结OpenVoice 把音色和语气拆开处理让你用 15 秒音频克隆声音并自由换语气、换语言MIT 协议可免费商用。它最适合给视频/播客批量配音、给作品做多语言版本。下一步建议通读 docs/USAGE.md 了解 V1/V2 细节遇到报错再翻 docs/QA.md。【免费下载链接】OpenVoiceInstant voice cloning by MIT and MyShell. Audio foundation model.项目地址: https://gitcode.com/GitHub_Trending/op/OpenVoice创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考