Duix Avatar Linux部署指南:4步搭建离线数字人视频生成环境
【免费下载链接】Duix-Avatar🚀 Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar
Duix Avatar 是一款完全在本地运行的开源数字人项目:上传约 10 秒视频即可克隆形象与声音,输入文字或音频就能生成口播视频。本文将带你用 4 步完成 Linux 上的完整部署,最终产出第一条数字人视频。
先确认能不能跑:系统与硬件要求
部署前先看一眼下面的配置表。标「必要」的是硬性要求,不满足时服务大概率启动不起来。
| 项目 | 硬性要求 | 推荐配置 |
|---|---|---|
| 系统 | Ubuntu 22.04 Desktop(官方已测试) | 其他桌面 Linux 发行版可尝试,未做兼容性测试 |
| 显卡 | NVIDIA 显卡 + 正确安装的驱动(必要) | RTX 4070 及以上 |
| 内存 | 32G(必要,16G 可能启动不了) | 32G 及以上 |
| CPU | 常规多核处理器 | 13代 Intel Core i5-13400F 及以上 |
| 硬盘 | — | 100G 以上空闲(首次启动需下载约 70G 镜像) |
运行下面这条自检命令,一次性确认 GPU 驱动、Docker、磁盘空间三个前提:
# 自检:查看显卡驱动、Docker 版本、主目录可用空间 nvidia-smi docker --version df -h ~完成判据:nvidia-smi输出包含显卡型号和驱动版本的表格;docker --version输出版本号(没有输出 Docker 没关系,第 1 步会装);主目录剩余空间大于 100G。
部署主流程(4 步)
第 1 步:用一条命令安装 Docker 与 Docker Compose
本步目的:装好容器运行时,后面三个数字人服务都跑在容器里。
# 从 apt 仓库安装 Docker 与 Docker Compose(已安装则跳过) sudo apt update sudo apt install -y docker.io docker-compose成功会看到:docker --version与docker-compose version都能输出版本号。
第 2 步:三条命令配置 Docker 的 GPU 直通
本步目的:让容器能调用 NVIDIA 显卡,项目所有算力都在 GPU 上,没有它服务起不来。
# 1) 添加 NVIDIA 容器工具包仓库 distribution=$(. /etc/os-release;echo $ID$VERSION_ID) \ && curl -s -L https://nvidia.github.io/libnvidia-container/gpgkey | sudo apt-key add - \ && curl -s -L https://nvidia.github.io/libnvidia-container/$distribution/libnvidia-container.list | sudo tee /etc/apt/sources.list.d/nvidia-container-toolkit.list # 2) 安装工具包,并配置 Docker 使用 NVIDIA 运行时 sudo apt-get update sudo apt-get install -y nvidia-container-toolkit sudo nvidia-ctk runtime configure --runtime=docker # 3) 重启 Docker 使配置生效 sudo systemctl restart docker成功会看到:configure命令无报错,且执行docker run --rm --gpus all nvidia/cuda:12.2.0-base nvidia-smi后容器内也能打印出显卡信息。
第 3 步:克隆仓库,用 docker-compose 拉起服务端三个服务
本步目的:启动语音合成(tts)、语音识别(asr)、视频合成(gen-video)三个后端服务。
# 克隆 Duix Avatar 项目 git clone https://gitcode.com/GitHub_Trending/he/Duix-Avatar # 用 Linux 版 compose 文件启动服务(首次约下载 70G 镜像,耗时较长) cd Duix-Avatar/deploy docker-compose -f docker-compose-linux.yml up -d成功会看到:docker ps列出 duix-avatar-tts、duix-avatar-asr、duix-avatar-gen-video 三个容器,状态均为 Running。
提示:硬盘或显卡余量有限时,可改用 deploy/docker-compose-lite.yml,只启动视频合成一个服务(不含声音克隆)。
第 4 步:下载并启动 Duix Avatar Linux 客户端
本步目的:安装操作界面,后面的克隆和生成都在客户端里点按钮完成。到项目发布页下载 Linux 版本的 AppImage 文件(文件名形如 Duix.Avatar-x.x.x.AppImage)到任意目录。
# 赋予执行权限并启动客户端 chmod +x Duix.Avatar-x.x.x.AppImage ./Duix.Avatar-x.x.x.AppImage成功会看到:客户端主界面打开,能看到「Create Video」和「Create Avatar」两个入口。
验证与验收:确认数字人生成真的可用
用下面 3 个动作确认整个环境工作正常。
- 服务端全绿:执行
docker ps,三个服务(tts、asr、gen-video)状态都是 Running。 - 客户端连通:客户端首页正常加载,点击右侧「Create Avatar」能进入上传页,没有报错弹窗。
- 产出第一条视频:点击「Create Avatar」上传一段 10 秒左右、有你在说话的真人视频,处理完成后模型出现在「My Avatars」列表;再选择该模型输入一段文字生成口播视频,能正常播放即部署完成。
避坑速查:Duix Avatar 部署最常见的 5 个问题
| 症状 | 解法 |
|---|---|
拉镜像报request canceled/ 连接超时 | 给/etc/docker/daemon.json加registry-mirrors镜像源(示例见 doc/常见问题.md),再执行sudo systemctl restart docker |
| 三个服务启动失败或反复重启 | 先执行nvidia-smi确认驱动,再确认第 2 步的工具包已安装且 Docker 已重启 |
定制模特报Connection refused | asr 服务启动较慢,服务端启动后等几分钟再试;仍报错则检查内存是否达到 32G |
| 创建模特报错 | 上传的视频必须有声音且是人在说话,程序要用它做声音克隆 |
| root 用户下 AppImage 无法启动 | 在终端加参数运行:./Duix.Avatar-x.x.x.AppImage --no-sandbox |
镜像源配置参考下图,Linux 下等价于编辑/etc/docker/daemon.json加入相同的registry-mirrors字段:
进阶入口:绕过客户端直接调数字人合成 API
Docker 启动后服务端会在本地暴露 HTTP 接口(如 18180 端口处理语音、8383 端口提交视频合成),你可以跳过客户端,用代码完成模特训练、音频合成与视频合成。接口参数说明见 README_zh.md 的「开放 API」一节,相关调用代码在 src/main/service/ 目录下的 model.js、video.js、voice.js。
写在最后
到这里,你拥有一套不依赖外网、形象与数据全部留在本地的数字人环境。后续操作中遇到问题,先查 doc/常见问题.md;客户端日志可通过右上角「设置 → 打开日志」查看,排查问题时用得上。
【免费下载链接】Duix-Avatar🚀 Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考