免费开源AI数字人克隆工具Duix.Avatar:本地数字人克隆部署教程
【免费下载链接】Duix-Avatar🚀 Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar
Duix.Avatar 是一款免费开源的 AI 数字人克隆工具,支持完全本地化部署。你只需上传一段 10 秒左右的视频,即可完成人脸与声音克隆,再用文字或音频驱动数字人生成口播视频。它适合想做口播视频又不想素材上云的内容创作者和开发者,全程无需联网,素材和模型都不会离开你的电脑。
🚀 快速跑起来:Docker 一键启动 Duix.Avatar 服务端
开始前先确认机器满足以下条件:
- 显卡:NVIDIA 显卡(推荐 RTX 4070),且已正确安装驱动
- 内存:32GB 及以上
- 硬盘:空闲空间 100G 以上,用于存放镜像和数据
- 系统:Windows 10 19042.1526 或更高版本,或 Ubuntu 22.04,并装好 Docker
然后依次执行:
git clone https://gitcode.com/GitHub_Trending/he/Duix-Avatar cd Duix-Avatarcd deploy docker-compose up -d首次启动会自动拉取三个 Docker 镜像,流量约 70G,耗时半小时左右,具体取决于网速。确认部署成功:在 Docker Desktop 中看到duix-avatar-tts、duix-avatar-asr、duix-avatar-gen-video三个服务均为 Running 状态即可。
Ubuntu 用户把第二条命令换成docker-compose -f docker-compose-linux.yml up -d;如果只需要视频生成功能,可以改用轻量的 deploy/docker-compose-lite.yml 配置文件。服务端起来后,从项目 Release 页面下载对应系统的客户端安装包,Windows 双击 exe 安装,Linux 直接运行 AppImage 即可使用。
启动前可在 Docker 的 Resources 设置中检查磁盘与内存分配是否充足
🎬 它能做什么:数字人克隆、口播视频与离线隐私保护
10 秒视频完成人脸和声音克隆
不用录制长篇视频。拍一段 10 秒左右、光线充足的正面视频上传,系统会自动提取面部特征,同时克隆你的声音,得到一个外形和音色都接近本人的数字分身。
文字或音频驱动数字人口播
模型建好后,做视频有两种方式:输入一段文字,数字人自动朗读并匹配口型;或者上传音频文件,数字人跟着音频的节奏和语调生成画面。两种方式最终都输出一段可直接发布的口播视频。
主界面把「Create Video」和「Create Avatar」两个核心功能并列摆放,流程清晰
全离线运行,素材不出本地
三个服务全部跑在你自己的电脑上,上传的视频、音频以及生成的模型都不会被传送到任何外部服务器。对企业来说,敏感素材没有网络传输风险;对个人来说,部署一次就能长期使用,没有按次调用费用。
多语言脚本与多模型管理
口播脚本支持中文、英语、日语、韩语、法语、德语、阿拉伯语、西班牙语共 8 种语言。你可以创建并保存多个数字人模型,在客户端一键切换,不同主题用不同形象出镜。
🎯 适合谁用:口播视频批量制作与标准化培训
最典型的使用者是自媒体创作者,需要持续产出口播内容。具体流程:先录一段 10 秒的出镜自我介绍,在客户端克隆数字人;之后把写好的文章转成脚本文字,提交生成口播视频,导出后发布到各平台。模型建好之后,换内容只需要换文字,不用反复出镜拍摄,日更也能维持。
另一个常见场景是企业内部培训或在线课程。先录一段讲师的简短介绍视频并克隆模型,把课件内容整理成文字脚本,批量生成标准化培训视频。课件更新时重新输入新文本即可再生成,同一数字人在全部内容中保持形象一致,也便于后续做多语言版本。
开发者还可以直接调用本地 API:Docker 启动后会暴露本地端口,接口调用方式可参考 src/main/service/model.js 和 src/main/service/video.js 中的实现。
⚠️ 避坑指南:Duix.Avatar 部署与克隆常见报错解决
1. 拉镜像失败,报registry-1.docker.io连接超时
- 现象:执行
docker-compose up -d后,三个服务逐个报拉取失败、请求超时。 - 原因:Docker Hub 官方源连接不稳定,拉取过程被中断。
- 解决:在 Docker 的
registry-mirrors配置中加入可用的国内镜像源,重启 Docker 后重新执行部署命令。
在 Docker 配置中为 registry-mirrors 添加可用的国内镜像源地址
2. 新增模特时直接报错,克隆失败
- 现象:上传视频后,客户端提示创建模特失败。
- 原因:视频没有声音,或者画面里没有人说话,程序无法用这段声音做声音克隆。
- 解决:换用一段 10~15 秒、人物说话清晰、光线充足的正面视频重新上传。
3. 克隆形象时报Connection refused
- 现象:服务端日志出现连接语音识别服务被拒绝的报错。
- 原因:语音识别服务启动较慢,客户端操作发起得太早;也可能是内存不足导致服务没有完全起来。
- 解决:服务端全部启动后等待几分钟再执行克隆;内存建议保持在 32G 以上。
更多排查步骤和日志查看方法可以查阅 doc/常见问题.md,提问前先对照自查一遍,能省下不少时间。
写在最后
Duix.Avatar 把人脸克隆、声音克隆和口型合成三件事全部放在本地完成,适合需要大量产出口播视频、又不想让素材外流的场景。完整的安装细节、开放 API 参数和授权协议,可以在 README_zh.md 与 LICENSE 中找到,有 NVIDIA 显卡的机器都可以直接动手试试。
【免费下载链接】Duix-Avatar🚀 Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考