news 2026/9/11 8:30:22

Duix.Avatar Linux 部署完整指南:三步在本地跑通免费 AI 数字人视频生成

作者头像

张小明

前端开发工程师

1.2k 24
文章封面图
Duix.Avatar Linux 部署完整指南:三步在本地跑通免费 AI 数字人视频生成

Duix.Avatar Linux 部署完整指南:三步在本地跑通免费 AI 数字人视频生成

【免费下载链接】Duix-Avatar🚀 Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar

Duix.Avatar 是一款免费开源的 AI 数字人工具,只需一段 10 秒左右的视频就能克隆你的形象和声音,输入文案或上传音频即可离线生成口播视频。本文带你用 Docker 在 Linux 上完成部署,从环境检查到第一次生成视频,全程可自查、可复现。

📌 先认识一下 Duix.Avatar:形象声音双克隆,全程离线

Duix.Avatar 是 Duix.com 开源的数字人工具箱,核心能力有三点:

  • 高精度克隆:用一段真人视频同时构建面部模型和声音模型,五官轮廓和语调语速都能还原
  • 文字与语音双驱动:写文案或直接上传音频,数字人自动对口型
  • 全离线运行:所有计算都在本机完成,视频不上传,隐私数据不出内网

它支持中文、英语、日语、韩语、法语、德语、阿拉伯语、西班牙语八种语言脚本,普通电脑即可把专业级数字人的制作成本打下来,值得动手试一次。

✅ 开跑前自查:对照清单确认你的机器

部署前先把条件对一遍,任何一条不满足都会让后面的步骤卡住。

项目要求说明
系统Ubuntu 22.04(已验证)其他桌面 Linux 理论可行,未做兼容性测试
显卡NVIDIA 显卡 + 正确驱动硬性条件,算力全在本地
参考配置i5-13400F / RTX 4070官方推荐档位,可低配但内存不能少
内存32GB 及以上必要条件,16GB 可能导致 ASR 服务起不来
硬盘100GB 以上可用首次拉取镜像约消耗 70GB 流量
依赖Docker + Docker Compose服务端基于容器运行

一条命令确认 GPU 驱动就绪:

nvidia-smi

能打印出显卡和驱动版本,这项就算通过。

🛠️ 部署主线:配好 GPU 容器运行时,拉齐三个服务

安装 Docker 并配置 GPU 容器运行时

如果系统还没有 Docker,用 apt 装好基础组件:

sudo apt update sudo apt install docker.io docker-compose docker --version

打印出版本号即安装成功。接下来装 NVIDIA Container Toolkit,这是 Docker 调用 GPU 的必要组件:

distribution=$(. /etc/os-release;echo $ID$VERSION_ID) \ && curl -s -L https://nvidia.github.io/libnvidia-container/gpgkey | sudo apt-key add - \ && curl -s -L https://nvidia.github.io/libnvidia-container/$distribution/libnvidia-container.list | sudo tee /etc/apt/sources.list.d/nvidia-container-toolkit.list
sudo apt-get update sudo apt-get install -y nvidia-container-toolkit sudo nvidia-ctk runtime configure --runtime=docker sudo systemctl restart docker

最后一条命令无报错、Docker 服务正常重启,GPU 运行时就配好了。

克隆仓库并启动服务端

把代码拉到本地,用 Linux 专用编排文件一键启动:

git clone https://gitcode.com/GitHub_Trending/he/Duix-Avatar cd Duix-Avatar/deploy docker-compose -f docker-compose-linux.yml up -d

首次启动要下载约 70GB 镜像,耗时半小时左右,网速决定一切,建议挂着跑。

验证服务是否就绪

跑完之后检查容器状态:

docker-compose ps

看到duix-avatar-ttsduix-avatar-asrduix-avatar-gen-video三个容器都是 Running,服务就起齐了。再打开 Docker 容器日志,确认 TTS 服务打印出 "ready for startup"、nginx 开始监听,说明推理端点已可被调用:

🎬 首次使用:从一段视频到一条口播片

服务端就绪后,从项目发布页下载 Linux 版客户端 AppImage,双击即可运行,无需安装:

./Duix.Avatar-x.x.x.AppImage

如果是 root 用户运行,要在终端加参数:

./Duix.Avatar-x.x.x.AppImage --no-sandbox

打开客户端后的路径很短:点右上角Create Avatar,上传一段 10 秒左右、画面清晰且本人在说话的带声音视频,等待克隆完成得到一个数字人形象;再点Create Video,选择刚建的数字人,输入文案或上传音频,几分钟后就能在 My Works 里看到一条口型同步的口播视频。

🩹 踩坑速查:三个高频问题

拉镜像连接超时现象:docker-compose up -drequest canceled while waiting for connection。 原因:Docker Hub 官方源在国内连接不稳定。 解法:在/etc/docker/daemon.json添加registry-mirrors国内镜像源后重启 Docker 再拉取。

克隆形象报 Connection refused现象:新建模特时 ASR 服务连接被拒绝,任务失败。 原因:ASR 服务启动比视频合成服务慢很多,客户端没有等它就提交任务。 解法:服务端启动后先等几分钟再操作克隆;如果机器内存只有 16GB,ASR 服务可能根本起不来,需按清单升到 32GB。

客户端行为异常说不清现象:界面报错模糊,找不到原因。 原因:客户端日志默认不展示。 解法:点右上角 Setting 菜单里的 Open Log 打开日志,把关键报错贴出来对照排查。

🔌 进阶入口:API 与源码

开放 API 在 Docker 启动后本地可用,覆盖模特训练、音频合成、视频合成与进度查询,细节见 README_zh.md:

  • 形象训练与合成服务:src/main/service/model.js
  • 视频合成服务:src/main/service/video.js
  • 语音服务:src/main/service/voice.js
  • 客户端请求封装:src/main/api/
  • 服务端编排文件:deploy/docker-compose-linux.yml

📎 写在最后

Duix.Avatar 的价值在于把形象与声音双克隆、离线口播生成这两件事压到一套可以自查的部署流程里,跑通之后所有生成都在本机闭环。遇到卡点先看 doc/常见问题.md,社区更新频繁,提交 issue 通常也能得到快速响应。

【免费下载链接】Duix-Avatar🚀 Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

版权声明: 本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若内容造成侵权/违法违规/事实不符,请联系邮箱:809451989@qq.com进行投诉反馈,一经查实,立即删除!
网站建设 2026/9/11 8:29:32

大文件断点续传上传插件实战:切片、哈希与Web Worker

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

作者头像 李华
网站建设 2026/9/11 8:26:32

如何彻底卸载数字人工具HeyGem.ai:三层清理法一次讲清

如何彻底卸载数字人工具HeyGem.ai:三层清理法一次讲清 【免费下载链接】Duix-Avatar 🚀 Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning. 项目地址: https://gitcode.com/GitHub_Trendi…

作者头像 李华
网站建设 2026/9/11 8:24:25

CesiumJS 导出:从场景截图到数据导出的保姆级教程

CesiumJS 导出:从场景截图到数据导出的保姆级教程 【免费下载链接】cesium An open-source JavaScript library for world-class 3D globes and maps :earth_americas: 项目地址: https://gitcode.com/GitHub_Trending/ce/cesium 你用 CesiumJS 搭好的三维场…

作者头像 李华
网站建设 2026/9/11 8:22:56

堆的基本存储:完全二叉树与数组的天然映射

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

作者头像 李华