news 2026/9/11 11:27:45

Duix Avatar Linux部署指南:4步搭建离线数字人视频生成环境

作者头像

张小明

前端开发工程师

1.2k 24
文章封面图
Duix Avatar Linux部署指南:4步搭建离线数字人视频生成环境

Duix Avatar Linux部署指南:4步搭建离线数字人视频生成环境

【免费下载链接】Duix-Avatar🚀 Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar

Duix Avatar 是一款完全在本地运行的开源数字人项目:上传约 10 秒视频即可克隆形象与声音,输入文字或音频就能生成口播视频。本文将带你用 4 步完成 Linux 上的完整部署,最终产出第一条数字人视频。

先确认能不能跑:系统与硬件要求

部署前先看一眼下面的配置表。标「必要」的是硬性要求,不满足时服务大概率启动不起来。

项目硬性要求推荐配置
系统Ubuntu 22.04 Desktop(官方已测试)其他桌面 Linux 发行版可尝试,未做兼容性测试
显卡NVIDIA 显卡 + 正确安装的驱动(必要)RTX 4070 及以上
内存32G(必要,16G 可能启动不了)32G 及以上
CPU常规多核处理器13代 Intel Core i5-13400F 及以上
硬盘100G 以上空闲(首次启动需下载约 70G 镜像)

运行下面这条自检命令,一次性确认 GPU 驱动、Docker、磁盘空间三个前提:

# 自检:查看显卡驱动、Docker 版本、主目录可用空间 nvidia-smi docker --version df -h ~

完成判据:nvidia-smi输出包含显卡型号和驱动版本的表格;docker --version输出版本号(没有输出 Docker 没关系,第 1 步会装);主目录剩余空间大于 100G。

部署主流程(4 步)

第 1 步:用一条命令安装 Docker 与 Docker Compose

本步目的:装好容器运行时,后面三个数字人服务都跑在容器里。

# 从 apt 仓库安装 Docker 与 Docker Compose(已安装则跳过) sudo apt update sudo apt install -y docker.io docker-compose

成功会看到:docker --versiondocker-compose version都能输出版本号。

第 2 步:三条命令配置 Docker 的 GPU 直通

本步目的:让容器能调用 NVIDIA 显卡,项目所有算力都在 GPU 上,没有它服务起不来。

# 1) 添加 NVIDIA 容器工具包仓库 distribution=$(. /etc/os-release;echo $ID$VERSION_ID) \ && curl -s -L https://nvidia.github.io/libnvidia-container/gpgkey | sudo apt-key add - \ && curl -s -L https://nvidia.github.io/libnvidia-container/$distribution/libnvidia-container.list | sudo tee /etc/apt/sources.list.d/nvidia-container-toolkit.list # 2) 安装工具包,并配置 Docker 使用 NVIDIA 运行时 sudo apt-get update sudo apt-get install -y nvidia-container-toolkit sudo nvidia-ctk runtime configure --runtime=docker # 3) 重启 Docker 使配置生效 sudo systemctl restart docker

成功会看到:configure命令无报错,且执行docker run --rm --gpus all nvidia/cuda:12.2.0-base nvidia-smi后容器内也能打印出显卡信息。

第 3 步:克隆仓库,用 docker-compose 拉起服务端三个服务

本步目的:启动语音合成(tts)、语音识别(asr)、视频合成(gen-video)三个后端服务。

# 克隆 Duix Avatar 项目 git clone https://gitcode.com/GitHub_Trending/he/Duix-Avatar # 用 Linux 版 compose 文件启动服务(首次约下载 70G 镜像,耗时较长) cd Duix-Avatar/deploy docker-compose -f docker-compose-linux.yml up -d

成功会看到:docker ps列出 duix-avatar-tts、duix-avatar-asr、duix-avatar-gen-video 三个容器,状态均为 Running。

提示:硬盘或显卡余量有限时,可改用 deploy/docker-compose-lite.yml,只启动视频合成一个服务(不含声音克隆)。

第 4 步:下载并启动 Duix Avatar Linux 客户端

本步目的:安装操作界面,后面的克隆和生成都在客户端里点按钮完成。到项目发布页下载 Linux 版本的 AppImage 文件(文件名形如 Duix.Avatar-x.x.x.AppImage)到任意目录。

# 赋予执行权限并启动客户端 chmod +x Duix.Avatar-x.x.x.AppImage ./Duix.Avatar-x.x.x.AppImage

成功会看到:客户端主界面打开,能看到「Create Video」和「Create Avatar」两个入口。

验证与验收:确认数字人生成真的可用

用下面 3 个动作确认整个环境工作正常。

  1. 服务端全绿:执行docker ps,三个服务(tts、asr、gen-video)状态都是 Running。
  2. 客户端连通:客户端首页正常加载,点击右侧「Create Avatar」能进入上传页,没有报错弹窗。
  3. 产出第一条视频:点击「Create Avatar」上传一段 10 秒左右、有你在说话的真人视频,处理完成后模型出现在「My Avatars」列表;再选择该模型输入一段文字生成口播视频,能正常播放即部署完成。

避坑速查:Duix Avatar 部署最常见的 5 个问题

症状解法
拉镜像报request canceled/ 连接超时/etc/docker/daemon.jsonregistry-mirrors镜像源(示例见 doc/常见问题.md),再执行sudo systemctl restart docker
三个服务启动失败或反复重启先执行nvidia-smi确认驱动,再确认第 2 步的工具包已安装且 Docker 已重启
定制模特报Connection refusedasr 服务启动较慢,服务端启动后等几分钟再试;仍报错则检查内存是否达到 32G
创建模特报错上传的视频必须有声音且是人在说话,程序要用它做声音克隆
root 用户下 AppImage 无法启动在终端加参数运行:./Duix.Avatar-x.x.x.AppImage --no-sandbox

镜像源配置参考下图,Linux 下等价于编辑/etc/docker/daemon.json加入相同的registry-mirrors字段:

进阶入口:绕过客户端直接调数字人合成 API

Docker 启动后服务端会在本地暴露 HTTP 接口(如 18180 端口处理语音、8383 端口提交视频合成),你可以跳过客户端,用代码完成模特训练、音频合成与视频合成。接口参数说明见 README_zh.md 的「开放 API」一节,相关调用代码在 src/main/service/ 目录下的 model.js、video.js、voice.js。

写在最后

到这里,你拥有一套不依赖外网、形象与数据全部留在本地的数字人环境。后续操作中遇到问题,先查 doc/常见问题.md;客户端日志可通过右上角「设置 → 打开日志」查看,排查问题时用得上。

【免费下载链接】Duix-Avatar🚀 Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

版权声明: 本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若内容造成侵权/违法违规/事实不符,请联系邮箱:809451989@qq.com进行投诉反馈,一经查实,立即删除!
网站建设 2026/9/11 11:27:21

Dataiku DSS图表功能详解与实战技巧

1. Dataiku DSS图表功能深度解析Dataiku DSS(Data Science Studio)作为一款领先的企业级数据科学平台,其图表功能(Charts)是数据分析师日常工作中最常用的核心模块之一。Concept-8版本对可视化系统进行了重大升级&…

作者头像 李华
网站建设 2026/9/11 11:25:16

WorkBuddy实战指南:从AI工作台到自动化工作流的构建与优化

刚接触CloudQ WorkBuddy那会儿,我一度以为它只是个带聊天框的笔记工具。真正用了一个月,把会议纪要做到自动同步、让它在凌晨定时把日报推到微信、又折腾完本地方案和远端环境的记忆迁移之后,我才意识到这玩意儿其实是把“AI智能体”和“自动…

作者头像 李华
网站建设 2026/9/11 11:22:24

Web技术演进与工程实践:从静态页面到AI驱动的智能化应用

从1991年第一个网页诞生到今天,Web已经走过了三十多年。我入行时还在用table布局切图,现在已经带着团队做AI驱动的Web应用,回头看这条演进路线,其实有一条非常清晰的主线: 每一次Web技术的跃迁,本质上都是…

作者头像 李华
网站建设 2026/9/11 11:21:36

Windows系统非编程环境下部署OpenClaw AI工具链实战

1. 项目概述:OpenClaw在Windows系统的非编程环境部署 OpenClaw作为一款新兴的多模态AI工具链,近期在技术社区引发了广泛关注。但官方文档主要面向Linux环境和开发者群体,这让许多Windows普通用户望而却步。我在一台配置为i5-8250U/8GB内存的旧…

作者头像 李华
网站建设 2026/9/11 11:15:02

基于Java的物联网智能监控平台开发实战:从MQTT到Spring Boot

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

作者头像 李华