ARTICLE DETAIL

资讯详情

深耕郑州网站建设与运营推广的一线实战洞察。

3 步完成零样本语音克隆:让 AI 免费商用你的声音

3 步完成零样本语音克隆:让 AI 免费商用你的声音 3 步完成零样本语音克隆让 AI 免费商用你的声音【免费下载链接】OpenVoiceInstant voice cloning by MIT and MyShell. Audio foundation model.项目地址: https://gitcode.com/GitHub_Trending/op/OpenVoice你只有一段十几秒的录音OpenVoice 就能克隆你的音色让 AI 用你的声音说出任意文字。这是零样本语音克隆不需要训练模型MIT 许可商用免费。先说结果它能帮你做成什么录一段自己的声音把产品文案、公告交给 AI读出来就像你本人在念。给视频、播客配音不用每次亲自进录音棚。参考音频是中文也能生成英语、日语的语音——跨语言克隆参考和生成的语言都可以没出现过。语音克隆原理一句话就能讲通看这张 OpenVoice 语音克隆框架图流程分两条线一条是文本内容加风格参数交给基础说话人 TTS 模型决定说什么、什么情绪和口音另一条是你的参考音频音调提取器从中抽出音色特征。最后两条线合到一起由解码器合成语音——内容、风格、音色各管一段这就是它既能换语言又能保留你音色的原因。OpenVoice 实操准备工作与 4 步分步操作准备工作在线体验无需装任何东西直接在 myshell.ai 的 Workshop 里搭一个 Bot 就能跑。本地部署克隆仓库按 requirements.txt 装依赖再下载模型权重解压到checkpoints_v2文件夹。git clone https://gitcode.com/GitHub_Trending/op/OpenVoice4 步在 Workshop 里克隆你的声音打开 Workshop新建一个 Bot。这是语音克隆的起点建好后你会得到一个空白画布可以往里拖组件。添加 TTS Widget。在组件区找到 TTS 相关选项拖进画布这一步做完画布上会出现一个可以输入文字、输出语音的模块。点击任意一个 TTS 模型。这是 OpenVoice 的基础说话人负责语气和口音。选中后模型会接入你的 Bot之后所有生成都由它打底。上传一段参考语音输入文字生成声音。系统分析音色特征后输出音频听起来就是用你的声音在念那段文字。本地跑通的话用一行命令python -m openvoice_app --share起 Gradio 页面操作逻辑一样V2 用法可看 demo_part3.ipynb。常见坑4 条速查参考音频要干净带背景噪音、多人在场、中间夹长静音音色都会跑偏。同名音频记得清缓存换了文件但没删processed文件夹用的还是旧的处理结果。它只克隆音色不克隆口音和情绪想要什么情绪、什么口音换对应的基础 TTS 模型就行。V2 原生支持 6 种语言英、西、法、中、日、韩音质也比 V1 更好V1、V2 都免费商用。最后一段录音换一套声音资产剩下的就是文档里的事了docs/USAGE.md。【免费下载链接】OpenVoiceInstant voice cloning by MIT and MyShell. Audio foundation model.项目地址: https://gitcode.com/GitHub_Trending/op/OpenVoice创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表