Duix.Avatar本地部署指南:30分钟跑通数字人克隆与离线视频生成
2026/9/11 7:44:24 网站建设 项目流程

Duix.Avatar本地部署指南:30分钟跑通数字人克隆与离线视频生成

【免费下载链接】Duix-Avatar🚀 Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar

Duix.Avatar 是一款完全开源、可在全离线电脑上运行的数字人项目:提交一段 10 秒左右的视频,即可克隆你的形象和声音,再输入文字或上传音频,自动生成口型匹配的播报视频。这篇指南按装服务端、装客户端、出第一个视频的完整流程走一遍,看完你就能在本地跑起整套本地部署。

👀 先看效果

部署完成后你会得到一个桌面工作台,首页有“Create Video”和“Create Avatar”两个入口,下方列表分 My Avatars 与 My Works 两个标签,分别存放你克隆的数字人形象和生成的成片视频。整条链路就是:交一段带人声的视频得到形象,输一段文字得到成片。

首页直接展示已克隆的数字人(My Avatars)和已生成的成片(My Works)

环境要求与自检

项目最低要求检查方式或处理方法
操作系统Windows 10(19042 及以上)或 Ubuntu 22.04Windows 在“设置→系统→关于”查看版本;Linux 执行lsb_release -a
显卡NVIDIA 独显且已装官方驱动终端执行nvidia-smi,能看到型号与驱动版本即通过;没有独显服务起不来
内存32GB 及以上任务管理器查看已安装内存;16GB 可能拉不起语音识别服务
硬盘系统盘 100GB+ 空余(存 Docker 镜像);Windows 另需一个 30GB+ 空余的数据盘(compose 默认挂 d:/duix_avatar_data)文件管理器查看磁盘;C 盘不够时安装 Docker 后可改镜像存储位置
前置软件Docker(Windows 版依赖 WSL2);Linux 另需 docker-compose 与 NVIDIA Container Toolkit执行docker --version;Windows 再执行wsl --list --verbose确认 WSL2 已安装

部署

项目分两部分:服务端是三个 Docker 容器,客户端是桌面应用。先获取代码,deploy/ 目录里就是服务端启动配置。

git clone https://gitcode.com/GitHub_Trending/he/Duix-Avatar

这条命令把整个项目拉到本地。

然后进入 deploy 目录启动服务:

cd deploy docker-compose up -d

这一条会后台拉起声音克隆(tts)、语音识别(asr)、视频合成(gen-video)三个服务。首次启动要拉约 70GB 镜像,耗时半小时到一小时不等,取决于网速。Ubuntu 22.04 把第二条换成docker-compose -f docker-compose-linux.yml up -d;NVIDIA 50 系显卡改用docker-compose-5090.yml

两处常见卡点先处理好:

  • 首次拉镜像容易超时。Docker Desktop 在 Settings → Docker Engine 的registry-mirrors里填一个国内镜像地址,保存后重试;Linux 改 /etc/docker/daemon.json,逻辑相同。

Docker Engine 配置页:registry-mirrors 填入国内镜像源可加速拉取

  • Windows 上镜像默认存 C 盘,空余不足 100GB 时,到 Settings → Resources → Advanced 用 Browse 把镜像存储挪到别的盘。

Resources → Advanced 面板中,可用 Browse 将 Docker 镜像存储迁移到空间更大的磁盘

最后装客户端:从项目 Releases 页下载对应版本的官方安装包,Windows 双击 exe 安装,Ubuntu 双击 AppImage 直接运行。客户端首页能正常打开,即部署成功。

第一次使用

  1. 同意协议:首次启动客户端后,右上角 Setting 里会显示 User Agreement,同意后进入主界面。
  2. 建形象:点右上角“Create Avatar”,上传一段 10 秒左右、面部清晰且持续讲话的视频。视频必须带声音且是人在说话,程序会用这段声音同时做声音克隆。
  3. 生成视频:点“Create Video”横幅,选刚建好的形象,输入播报文案或上传音频,开始生成。
  4. 看结果:完成后成片出现在首页“My Works”标签下,可在线播放或保存到本地。

右上角 Setting 菜单:Open Log 可随时打开客户端日志,User Agreement 为首次协议入口

🛠️ 排障速查

现象可能原因解决办法
docker-compose up -d拉镜像超时、报 context canceledDocker Hub 官方源不稳定按部署一节的图给 registry-mirrors 加国内镜像源后重试
三个容器起不来或反复重启没有 NVIDIA 显卡、驱动或 GPU 运行时缺失,或内存不足(16GB 及以下)nvidia-smi确认驱动;Windows 检查 WSL2,Linux 确认装了 NVIDIA Container Toolkit 并重启 Docker;内存建议升到 32GB
定制模特报错(Connection refused 等)上传视频无声音、无人说话;或服务端刚启动、语音识别服务还在初始化换带清晰人声的视频重新上传;服务端启动后等几分钟再执行克隆

深入一点

  • doc/常见问题.md:官方常见问题与提问前自查清单(服务状态、显卡驱动、日志获取方式)。
  • src/main/service/video.js:客户端调用视频合成接口的完整逻辑,想用自己的脚本批量出片,照这里调用本地 8383 端口即可。
  • src/main/dao/f2f-model.js:形象训练任务的提交与进度查询实现,适合定制模型管理流程时参考。

现在打开客户端,上传那段 10 秒的视频,完成第一次克隆。

【免费下载链接】Duix-Avatar🚀 Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

需要专业的网站建设服务?

联系我们获取免费的网站建设咨询和方案报价,让我们帮助您实现业务目标

立即咨询