Duix.Avatar本地部署指南:30分钟跑通数字人克隆与离线视频生成
【免费下载链接】Duix-Avatar🚀 Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar
Duix.Avatar 是一款完全开源、可在全离线电脑上运行的数字人项目:提交一段 10 秒左右的视频,即可克隆你的形象和声音,再输入文字或上传音频,自动生成口型匹配的播报视频。这篇指南按装服务端、装客户端、出第一个视频的完整流程走一遍,看完你就能在本地跑起整套本地部署。
👀 先看效果
部署完成后你会得到一个桌面工作台,首页有“Create Video”和“Create Avatar”两个入口,下方列表分 My Avatars 与 My Works 两个标签,分别存放你克隆的数字人形象和生成的成片视频。整条链路就是:交一段带人声的视频得到形象,输一段文字得到成片。
首页直接展示已克隆的数字人(My Avatars)和已生成的成片(My Works)
环境要求与自检
| 项目 | 最低要求 | 检查方式或处理方法 |
|---|---|---|
| 操作系统 | Windows 10(19042 及以上)或 Ubuntu 22.04 | Windows 在“设置→系统→关于”查看版本;Linux 执行lsb_release -a |
| 显卡 | NVIDIA 独显且已装官方驱动 | 终端执行nvidia-smi,能看到型号与驱动版本即通过;没有独显服务起不来 |
| 内存 | 32GB 及以上 | 任务管理器查看已安装内存;16GB 可能拉不起语音识别服务 |
| 硬盘 | 系统盘 100GB+ 空余(存 Docker 镜像);Windows 另需一个 30GB+ 空余的数据盘(compose 默认挂 d:/duix_avatar_data) | 文件管理器查看磁盘;C 盘不够时安装 Docker 后可改镜像存储位置 |
| 前置软件 | Docker(Windows 版依赖 WSL2);Linux 另需 docker-compose 与 NVIDIA Container Toolkit | 执行docker --version;Windows 再执行wsl --list --verbose确认 WSL2 已安装 |
部署
项目分两部分:服务端是三个 Docker 容器,客户端是桌面应用。先获取代码,deploy/ 目录里就是服务端启动配置。
git clone https://gitcode.com/GitHub_Trending/he/Duix-Avatar这条命令把整个项目拉到本地。
然后进入 deploy 目录启动服务:
cd deploy docker-compose up -d这一条会后台拉起声音克隆(tts)、语音识别(asr)、视频合成(gen-video)三个服务。首次启动要拉约 70GB 镜像,耗时半小时到一小时不等,取决于网速。Ubuntu 22.04 把第二条换成docker-compose -f docker-compose-linux.yml up -d;NVIDIA 50 系显卡改用docker-compose-5090.yml。
两处常见卡点先处理好:
- 首次拉镜像容易超时。Docker Desktop 在 Settings → Docker Engine 的
registry-mirrors里填一个国内镜像地址,保存后重试;Linux 改 /etc/docker/daemon.json,逻辑相同。
Docker Engine 配置页:registry-mirrors 填入国内镜像源可加速拉取
- Windows 上镜像默认存 C 盘,空余不足 100GB 时,到 Settings → Resources → Advanced 用 Browse 把镜像存储挪到别的盘。
Resources → Advanced 面板中,可用 Browse 将 Docker 镜像存储迁移到空间更大的磁盘
最后装客户端:从项目 Releases 页下载对应版本的官方安装包,Windows 双击 exe 安装,Ubuntu 双击 AppImage 直接运行。客户端首页能正常打开,即部署成功。
第一次使用
- 同意协议:首次启动客户端后,右上角 Setting 里会显示 User Agreement,同意后进入主界面。
- 建形象:点右上角“Create Avatar”,上传一段 10 秒左右、面部清晰且持续讲话的视频。视频必须带声音且是人在说话,程序会用这段声音同时做声音克隆。
- 生成视频:点“Create Video”横幅,选刚建好的形象,输入播报文案或上传音频,开始生成。
- 看结果:完成后成片出现在首页“My Works”标签下,可在线播放或保存到本地。
右上角 Setting 菜单:Open Log 可随时打开客户端日志,User Agreement 为首次协议入口
🛠️ 排障速查
| 现象 | 可能原因 | 解决办法 |
|---|---|---|
docker-compose up -d拉镜像超时、报 context canceled | Docker Hub 官方源不稳定 | 按部署一节的图给 registry-mirrors 加国内镜像源后重试 |
| 三个容器起不来或反复重启 | 没有 NVIDIA 显卡、驱动或 GPU 运行时缺失,或内存不足(16GB 及以下) | 用nvidia-smi确认驱动;Windows 检查 WSL2,Linux 确认装了 NVIDIA Container Toolkit 并重启 Docker;内存建议升到 32GB |
| 定制模特报错(Connection refused 等) | 上传视频无声音、无人说话;或服务端刚启动、语音识别服务还在初始化 | 换带清晰人声的视频重新上传;服务端启动后等几分钟再执行克隆 |
深入一点
- doc/常见问题.md:官方常见问题与提问前自查清单(服务状态、显卡驱动、日志获取方式)。
- src/main/service/video.js:客户端调用视频合成接口的完整逻辑,想用自己的脚本批量出片,照这里调用本地 8383 端口即可。
- src/main/dao/f2f-model.js:形象训练任务的提交与进度查询实现,适合定制模型管理流程时参考。
现在打开客户端,上传那段 10 秒的视频,完成第一次克隆。
【免费下载链接】Duix-Avatar🚀 Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考