news 2026/9/11 17:01:17

Duix-Avatar 开源数字人本地部署指南:从克隆代码到跑通第一条口播视频

作者头像

张小明

前端开发工程师

1.2k 24
文章封面图
Duix-Avatar 开源数字人本地部署指南:从克隆代码到跑通第一条口播视频

Duix-Avatar 开源数字人本地部署指南:从克隆代码到跑通第一条口播视频

【免费下载链接】Duix-Avatar🚀 Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar

Duix-Avatar 是一款完全开源的 AI 数字人工具包:上传一段短视频即可克隆你的形象和声音,再输入文字就能自动生成口播视频,全程本地离线完成。本文带你确认部署条件、跑通 Docker 服务端与客户端、完成首次验证,并处理最常见的启动故障。

🎬 三个真实场景:从个人博主到企业数字员工

  • 自媒体口播博主:你写了文案但不想出镜、不想反复配音。把文案交给克隆好的数字人,直接产出口型匹配的视频。
  • 企业培训与运营团队:需要批量制作产品讲解、制度宣导类视频。同一数字人换文案重复生成,不占拍摄排期。
  • 虚拟主播 / 直播筹备:提前离线生成素材视频,内容数据不经过任何外部服务器,发布前可反复修改。

三者的共同点:形象、声音、文案都在你自己的机器上处理,隐私和数据可控。

📋 部署条件清单:先核对这 6 项

部署前逐项确认,缺一项后续都会卡住:

项目硬性要求
操作系统Windows 10(19042 及以上)或 Ubuntu 22.04
显卡NVIDIA 显卡,且驱动正确安装(全部算力跑在本地 GPU 上)
内存32G 及以上;16G 可能导致服务启动失败
磁盘系统盘 100G 以上空闲(存 Docker 镜像,首次下载约 70G);Windows 另需 D 盘 30G 以上存数字人和作品
软件Docker(Windows 用 Docker Desktop,Linux 用 docker.io)、Git
驱动验证终端执行nvidia-smi能显示显卡型号和驱动版本

Windows 下 Docker 镜像和数据的存放位置可在 Docker Desktop 设置中调整,确保目标盘空间充足:

⚙️ 四步部署流程:从克隆代码到工作台启动

步骤 1:获取项目代码

做什么:把仓库拉取到本地,进入项目目录。

怎么做

git clone https://gitcode.com/GitHub_Trending/he/Duix-Avatar cd Duix-Avatar

怎样算成功:目录下能看到deploy/src/README_zh.md等文件。

步骤 2:准备 Docker 并验证 GPU

做什么:安装并启动 Docker,确认容器能调用显卡。Windows 用 Docker Desktop(基于 WSL);Ubuntu 执行sudo apt install docker.io docker-compose,并安装 NVIDIA 驱动与 NVIDIA Container Toolkit(它让 Docker 容器可以访问显卡)。

怎么做:在终端执行:

nvidia-smi docker --version

怎样算成功nvidia-smi输出显卡型号、显存和驱动版本,且无报错。网络环境拉取镜像慢时,可先在 Docker 配置中加入镜像源,见下文故障速查。

步骤 3:启动服务端三个容器

做什么:一键启动语音识别(ASR)、语音合成(TTS)、视频合成三个服务,配置文件位于 deploy/docker-compose.yml。

怎么做

cd deploy docker-compose up -d

不同环境对应不同配置:Linux 用docker-compose -f docker-compose-linux.yml up -d,RTX 50 系列显卡用docker-compose -f docker-compose-5090.yml up -d,显存吃紧可换轻量版docker-compose -f docker-compose-lite.yml up -d(仅视频合成一个服务)。

怎样算成功docker ps显示 3 个服务(轻量版 1 个)状态为 Running。首次拉取镜像约 70G,耗时取决于网速,官方提示约半小时。

关键配置项(在 compose 文件中按需调整):

  • GPU 资源分配与内存上限
  • 数据挂载路径(数字人、作品、音频的存放目录)
  • 端口映射:视频合成接口 8383、语音服务 18180,客户端通过127.0.0.1调用

步骤 4:安装客户端并连接工作台

做什么:客户端是 Electron 桌面应用,从项目官方构建产物下载对应安装包。Windows 双击Duix.Avatar-x.x.x-setup.exe安装;Ubuntu 下载Duix.Avatar-x.x.x.AppImage直接运行(root 用户需加--no-sandbox参数)。

怎样算成功:客户端打开,弹出用户协议,进入工作台首页。

✅ 验收部署并跑通最小闭环:克隆一个形象,生成一条视频

部署成功的三个标志

  1. docker ps中三个服务均为 Running;
  2. 客户端工作台正常加载,无连接报错;
  3. "My Avatars / My Works" 区域可见(初始为空)。

然后完成一次最小闭环体验:

  1. 同意用户协议,进入创作界面。
  2. Create Avatar:上传一段约 10 秒的视频。注意画面里人脸清晰,且必须有人在说话——声音会被用于克隆,静音视频会直接报错。
  3. 等待训练完成,数字人形象出现在列表中。
  4. Create Video:选择该数字人,输入文案,提交生成。
  5. 任务完成后在作品列表下载视频,检查口型与声音。

从上传素材到成片,全程不需要联网。

🛠️ 三个高频故障:快速速查问答

问:docker-compose up -d拉镜像超时,报net/http: request canceledcontext canceled

定位方法:这是 Docker Hub 官方源连接不稳定的典型表现。打开 Docker Desktop 的 Docker Engine 设置,在 JSON 中加入registry-mirrors镜像源数组(镜像源会随时间失效,自行检索最新可用地址),点 Apply & restart,然后重新执行docker-compose up -d

问:创建数字人时报错file not existsConnection refused

两个独立原因,分别排查:

  • 素材问题:视频必须包含清晰人声,且人是说话状态,程序要从中做声音克隆。
  • 服务未就绪:ASR 服务启动较慢,服务端刚拉起时不要立刻克隆形象,等几分钟再试。若内存只有 16G,服务可能根本没起来,回到条件清单核对。

问:报错信息在哪里看?

  • 客户端:右上角菜单选择"Open Log",日志文件main.log位于%AppData%\Roaming\heygem.ai\logs
  • 服务端:Docker 容器页点击对应服务的 Logs 标签页,找到时间戳最近的报错段,可复制后检索。

延伸阅读

  • 官方排障手册与提问模板:doc/常见问题.md
  • 服务端启动与资源配置:deploy/docker-compose.yml
  • 开放 API 源码参考(模型训练、视频合成、语音克隆的调用方式):src/main/service/video.js、src/main/service/model.js
  • 数字人模型数据层实现:src/main/dao/f2f-model.js

部署跑通只是开始。下一步:录一段十秒的自我介绍,克隆你的第一个数字分身,然后试着让一条文案变成一条成片。

【免费下载链接】Duix-Avatar🚀 Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

版权声明: 本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若内容造成侵权/违法违规/事实不符,请联系邮箱:809451989@qq.com进行投诉反馈,一经查实,立即删除!
网站建设 2026/9/11 17:01:06

本科生应对AIGC检测的有效工具与技术解析

1. 项目概述:本科生如何应对AIGC检测挑战去年我在指导本科毕业论文时发现一个现象:超过60%的学生初稿被系统标记"AIGC内容过高"。这并非全是抄袭问题,而是学生们普遍缺乏对AI生成内容检测机制的理解。本文基于导师团队实测的9款主流…

作者头像 李华
网站建设 2026/9/11 17:00:48

视频号定时自动发布工具实测对比,个人创作者低成本运营方案

做视频号个人创作,最挤占精力的往往不是剪辑,而是重复的发布工作:掐点守着发内容、多平台逐个上传、错过流量高峰影响账号权重,琐事积少成多,会大量占用创作时间。本人实测过多款定时发布工具,踩过账号异常…

作者头像 李华
网站建设 2026/9/11 17:00:46

3步搞定怎么自动发布到抖音,新手零门槛

一、新媒体矩阵行业现状与背景2026 年新媒体运营进入精细化阶段,自媒体、企业新媒体及中小 MCN 不再依赖单一账号流量,纷纷布局自媒体矩阵。行业调研数据显示,超 80% 的中腰部运营团队同时运维 5 个及以上多平台账号,全域矩阵分发…

作者头像 李华
网站建设 2026/9/11 16:59:23

Typst 安装配置指南:5 分钟搞定跨平台排版环境

Typst 安装配置指南:5 分钟搞定跨平台排版环境 【免费下载链接】typst A markup-based typesetting system that is powerful and easy to learn. 项目地址: https://gitcode.com/GitHub_Trending/ty/typst 改了一行公式,干等两分钟才出 PDF。Typ…

作者头像 李华
网站建设 2026/9/11 16:57:39

30m DEM与市级边界shp数据处理流程详解

简介:海南省澄迈县30米分辨率的DEM数字高程数据,附带县级范围Shapefile矢量文件,构成一套可直接用于GIS教学与基础分析的地理数据包。面向城乡规划、测绘工程、资源环境等方向的初学者与从业者,可利用30米精度栅格开展地形可视化、…

作者头像 李华