
Duix.Avatar数字人本地部署完整教程Docker四步跑通AI克隆形象与口播视频生成【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar想让自己的AI数字人开口说话、自动产出口播视频又不想依赖任何在线服务开源项目Duix.Avatar本仓库名 HeyGem.ai就是干这个的上传一段约10秒的说话视频它克隆你的形象和声音再输入文案或音频就能离线生成一条口型对得上的数字人视频。下面先把它跑起来再讲它能干什么、怎么用好。先弄清它能干什么数字人克隆的三块核心能力能力你能用它做什么说明形象 声音克隆上传一段约10秒的真人说话视频生成可反复复用的数字人模特AI捕捉五官轮廓与音色特征无需3D建模文本 / 语音驱动视频输入文案或上传音频自动合成开口说话的视频脚本支持中、英、日、韩、法、德、阿、西 8 种语言全离线运行所有计算都在本机完成素材不出机器需要一块 NVIDIA 显卡隐私和稳定性都更好能力看明白了但部署之前还有一个关键选择——用哪条路径装直接决定你后面要敲多少命令。动手之前先选对部署方式Docker 完整版默认推荐拉 3 个镜像分别负责语音合成TTS、语音识别ASR和视频生成功能最全。硬件要求NVIDIA 显卡 驱动、32GB 内存、约 100GB 空闲磁盘。适合想克隆自己形象的人。Docker Lite 精简版只跑视频生成那一个容器省资源、下载快。适合已有模特、只想批量生成视频的人。官方客户端安装包 服务端 Docker客户端直接下预构建的 exe / AppImage 双击就能用不用懂 Node。服务端仍需 Docker适合完全不想折腾代码的普通用户。源码自编译客户端npm装依赖后本地构建适合想改界面、加功能的开发者。注意一点这个项目的所有算力都在本地没有 NVIDIA 显卡或驱动没装好三个服务是起不来的动手前先确认。路径选好了下面跟着主路径Windows Docker 完整版走一遍。跟着四步操作把它跑起来第 1 步拿到项目代码git clone https://gitcode.com/GitHub_Trending/he/HeyGem.ai cd HeyGem.ai这一步把客户端代码和部署配置都拉到本地服务端配置集中在 deploy/ 目录里。第 2 步确认显卡驱动 装 Dockernvidia-smi # 能列出显卡信息说明驱动 OK wsl --list --verbose # 查看是否已装 WSL wsl --update # 更新 WSL然后从 Docker 官网装 Docker Desktop首次启动接受协议、跳过登录。如果 C 盘剩余空间不足 100GB在 Docker Desktop 的 Settings → Resources 里把镜像存储位置挪到空间够的磁盘第 3 步启动三个服务端容器cd deploy docker-compose up -d这一步会拉取约 70GB 的镜像并启动 TTS / ASR / 视频生成三个容器首次需要半小时左右建议连 WiFi 等它下完。如果只需要精简版把命令换成docker-compose -f docker-compose-lite.yml up -d即可。第 4 步打开客户端两种方式任选直接下载官方预构建安装包双击Duix.Avatar-x.x.x-setup.exeLinux 为 AppImage安装或者在仓库根目录从源码构建npm install npm run devUbuntu 22.04 用户看这里Ubuntu 上把第 2 步换成装 Docker 与 GPU 运行时即可sudo apt update sudo apt install docker.io docker-compose再装好 NVIDIA 驱动和 NVIDIA Container Toolkit让 Docker 能调用显卡然后cd deploy docker-compose -f docker-compose-linux.yml up -d装完没报错不等于装成功了下面教你怎么确认。确认部署成功看三个信号执行docker ps能看到duix-avatar-tts、duix-avatar-asr、duix-avatar-gen-video三个容器都是 UpLite 版只有duix-avatar-gen-video一个。打开客户端出现首页界面右上角有Create Video和Create Avatar两个入口走一遍完整链路才算真正跑通上传一段有真人说话声音的视频 → 创建数字人 → 输入文案点击生成 → 得到一条口型同步的口播视频。能导出视频说明整条链路都是好的。确认没问题后还有几个开关可以让它跑得更快、更省。让生成更快几个可选的进阶调优RTX 50 系显卡5090换用专用编排文件启动docker-compose -f docker-compose-5090.yml up -d30/40 系装了 CUDA 12.8 的也能用这套。内存 16GB 左右三个服务可能起不来建议 32GB显存紧张可先用 Lite 版体验流程。镜像拉取慢在 Docker 守护进程配置里加registry-mirrors见下面避坑清单第 1 条拉取速度差别很大。磁盘规划Windows 上默认用 D 盘存数字人和作品留 30GB容器数据目录映射在d:/duix_avatar_data可以在 deploy/docker-compose.yml 里改。想接进自己的系统三个服务在本地暴露了端口18180 语音合成、8383 视频合成接口调用示例可看 src/main/service/model.js、src/main/service/video.js。调优之外部署和首次使用时最容易踩的几个坑照着这张表自查最省时间。避坑清单常见问题现象 → 原因 → 处理现象原因处理docker-compose up -d报net/http: request canceled、context canceledDocker Hub 官方源连接不稳定在 Docker Desktop 的 Docker Engine 设置里配置国内镜像源见下图保存后重试新增模特直接报错上传的视频里没有真人说话的声音换一段本人在说话、声音清晰的视频约10秒即可声音克隆全靠它定制模特报Connection refusedASR 服务启动较慢或 16GB 内存带不动等三个容器都 Running 后等几分钟再操作内存建议 32GB 起步容器反复重启、起不来缺 NVIDIA 显卡或驱动没装好Docker 调不到 GPUnvidia-smi先确认驱动Ubuntu 需补装 nvidia-container-toolkitUbuntu 下 root 用户双击 AppImage 无反应沙箱限制终端执行./Duix.Avatar-x.x.x.AppImage --no-sandbox取日志的两个位置反馈问题前先看日志服务端在 Docker Desktop 里点开对应容器、切到 Logs 页签把关键报错复制出来客户端点右上角设置图标 → Open Log。跑通 Duix.Avatar 其实就这么四步拉代码、装 Docker、起容器、开客户端。接下来建议你把 常见问题文档 收藏备用有更深的需求API 集成、多语言脚本再翻翻 README_zh.md 的开放 API一节。【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考