Duix.Avatar Linux 部署完整指南:三步在本地跑通免费 AI 数字人视频生成
【免费下载链接】Duix-Avatar🚀 Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar
Duix.Avatar 是一款免费开源的 AI 数字人工具,只需一段 10 秒左右的视频就能克隆你的形象和声音,输入文案或上传音频即可离线生成口播视频。本文带你用 Docker 在 Linux 上完成部署,从环境检查到第一次生成视频,全程可自查、可复现。
📌 先认识一下 Duix.Avatar:形象声音双克隆,全程离线
Duix.Avatar 是 Duix.com 开源的数字人工具箱,核心能力有三点:
- 高精度克隆:用一段真人视频同时构建面部模型和声音模型,五官轮廓和语调语速都能还原
- 文字与语音双驱动:写文案或直接上传音频,数字人自动对口型
- 全离线运行:所有计算都在本机完成,视频不上传,隐私数据不出内网
它支持中文、英语、日语、韩语、法语、德语、阿拉伯语、西班牙语八种语言脚本,普通电脑即可把专业级数字人的制作成本打下来,值得动手试一次。
✅ 开跑前自查:对照清单确认你的机器
部署前先把条件对一遍,任何一条不满足都会让后面的步骤卡住。
| 项目 | 要求 | 说明 |
|---|---|---|
| 系统 | Ubuntu 22.04(已验证) | 其他桌面 Linux 理论可行,未做兼容性测试 |
| 显卡 | NVIDIA 显卡 + 正确驱动 | 硬性条件,算力全在本地 |
| 参考配置 | i5-13400F / RTX 4070 | 官方推荐档位,可低配但内存不能少 |
| 内存 | 32GB 及以上 | 必要条件,16GB 可能导致 ASR 服务起不来 |
| 硬盘 | 100GB 以上可用 | 首次拉取镜像约消耗 70GB 流量 |
| 依赖 | Docker + Docker Compose | 服务端基于容器运行 |
一条命令确认 GPU 驱动就绪:
nvidia-smi能打印出显卡和驱动版本,这项就算通过。
🛠️ 部署主线:配好 GPU 容器运行时,拉齐三个服务
安装 Docker 并配置 GPU 容器运行时
如果系统还没有 Docker,用 apt 装好基础组件:
sudo apt update sudo apt install docker.io docker-compose docker --version打印出版本号即安装成功。接下来装 NVIDIA Container Toolkit,这是 Docker 调用 GPU 的必要组件:
distribution=$(. /etc/os-release;echo $ID$VERSION_ID) \ && curl -s -L https://nvidia.github.io/libnvidia-container/gpgkey | sudo apt-key add - \ && curl -s -L https://nvidia.github.io/libnvidia-container/$distribution/libnvidia-container.list | sudo tee /etc/apt/sources.list.d/nvidia-container-toolkit.listsudo apt-get update sudo apt-get install -y nvidia-container-toolkit sudo nvidia-ctk runtime configure --runtime=docker sudo systemctl restart docker最后一条命令无报错、Docker 服务正常重启,GPU 运行时就配好了。
克隆仓库并启动服务端
把代码拉到本地,用 Linux 专用编排文件一键启动:
git clone https://gitcode.com/GitHub_Trending/he/Duix-Avatar cd Duix-Avatar/deploy docker-compose -f docker-compose-linux.yml up -d首次启动要下载约 70GB 镜像,耗时半小时左右,网速决定一切,建议挂着跑。
验证服务是否就绪
跑完之后检查容器状态:
docker-compose ps看到duix-avatar-tts、duix-avatar-asr、duix-avatar-gen-video三个容器都是 Running,服务就起齐了。再打开 Docker 容器日志,确认 TTS 服务打印出 "ready for startup"、nginx 开始监听,说明推理端点已可被调用:
🎬 首次使用:从一段视频到一条口播片
服务端就绪后,从项目发布页下载 Linux 版客户端 AppImage,双击即可运行,无需安装:
./Duix.Avatar-x.x.x.AppImage如果是 root 用户运行,要在终端加参数:
./Duix.Avatar-x.x.x.AppImage --no-sandbox打开客户端后的路径很短:点右上角Create Avatar,上传一段 10 秒左右、画面清晰且本人在说话的带声音视频,等待克隆完成得到一个数字人形象;再点Create Video,选择刚建的数字人,输入文案或上传音频,几分钟后就能在 My Works 里看到一条口型同步的口播视频。
🩹 踩坑速查:三个高频问题
拉镜像连接超时现象:docker-compose up -d报request canceled while waiting for connection。 原因:Docker Hub 官方源在国内连接不稳定。 解法:在/etc/docker/daemon.json添加registry-mirrors国内镜像源后重启 Docker 再拉取。
克隆形象报 Connection refused现象:新建模特时 ASR 服务连接被拒绝,任务失败。 原因:ASR 服务启动比视频合成服务慢很多,客户端没有等它就提交任务。 解法:服务端启动后先等几分钟再操作克隆;如果机器内存只有 16GB,ASR 服务可能根本起不来,需按清单升到 32GB。
客户端行为异常说不清现象:界面报错模糊,找不到原因。 原因:客户端日志默认不展示。 解法:点右上角 Setting 菜单里的 Open Log 打开日志,把关键报错贴出来对照排查。
🔌 进阶入口:API 与源码
开放 API 在 Docker 启动后本地可用,覆盖模特训练、音频合成、视频合成与进度查询,细节见 README_zh.md:
- 形象训练与合成服务:src/main/service/model.js
- 视频合成服务:src/main/service/video.js
- 语音服务:src/main/service/voice.js
- 客户端请求封装:src/main/api/
- 服务端编排文件:deploy/docker-compose-linux.yml
📎 写在最后
Duix.Avatar 的价值在于把形象与声音双克隆、离线口播生成这两件事压到一套可以自查的部署流程里,跑通之后所有生成都在本机闭环。遇到卡点先看 doc/常见问题.md,社区更新频繁,提交 issue 通常也能得到快速响应。
【免费下载链接】Duix-Avatar🚀 Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考