Duix-Avatar 本地部署教程:3步跑通离线数字人口播视频合成
【免费下载链接】Duix-Avatar🚀 Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar
不拍片也能做口播视频:丢给它一段 10 秒的真人出镜视频,Duix-Avatar 就能克隆你的脸和声音,让"你"照着任意文案念稿,输出口型对得上的视频。整个过程走离线本地部署,镜像、算力、素材全在自己机器上,也不用配 Python 环境。这篇带你从一台裸机走到第一条视频产出:装、起、跑通验证,外加最常见的 3 个卡点怎么处理。
先看机器:三个前置检查决定能不能起
Duix-Avatar 的全部算力跑在你本地 GPU 上,所以先确认机器达标,不达标别急着装——装了三个容器也起不来。
| 检查项 | 要求 | 说明 |
|---|---|---|
| 系统 | Windows 10 19042.1526+ 或 Ubuntu 22.04 | 目前官方适配两套 |
| 空闲磁盘 | 100GB 以上 | 首次拉镜像消耗约 70GB 流量 |
| 内存 | 32GB 及以上(必要) | 低于这个值服务会被杀 |
| 显卡 | 英伟达显卡且驱动已装好(必要) | 推荐 i5-13400F + RTX 4070 档 |
⚠️ 最常见的"装好了起不来"就是没装英伟达驱动。先在终端跑
nvidia-smi,能看到显卡信息再继续。
确认 WSL 并装好 Docker
Windows 上先看 WSL:wsl --list --verbose有输出说明已装,否则用wsl --install安装,再用wsl --update更新,然后按 CPU 架构装 Docker Desktop。Ubuntu 直接apt installdocker.io 和 docker-compose,另外装 NVIDIA Container Toolkit,让 Docker 能调用 GPU,不然容器没有算力。
装的过程:拉代码、配镜像、起服务
把 Docker 磁盘位置挪到空间充足的盘
三个镜像加起来几十 GB,别堆在 C 盘。Windows 版 Docker Desktop 里进 Settings → Resources → Advanced,把 Disk image location 指到一个剩余 100GB 以上的盘:
配镜像加速,防止拉取超时
fun-asr、fish-speech-ziming、duix.avatar 三个镜像拉下来要等,网络慢的机器必须配加速源。进 Settings → Docker Engine,在 JSON 配置里加上:
{ "registry-mirrors": [ "https://hub.littlediary.cn" ] }点 Apply & restart 生效。镜像源会随时间失效,用之前自己搜一下当前可用的。
克隆仓库并启动服务
克隆仓库并进入项目目录:
git clone https://gitcode.com/GitHub_Trending/he/Duix-Avatar cd Duix-Avatar到 deploy/ 目录后台启动;显存紧张就换 lite 版单服务定义:
cd deploy docker-compose up -d # 完整版起3个服务;lite版改用 docker-compose-lite.ymldeploy/ 里的 docker-compose.yml 一共定义 3 个容器:语音合成(18180 端口)、语音识别(10095)、视频合成(8383)。RTX 50 系显卡改换 docker-compose-5090.yml 启动。
验证环节:3个容器 Running,再开客户端
在 deploy 目录跑检查命令:
docker-compose ps三个服务全是 Running,后端就算就绪。接着装客户端:Windows 装官方构建的安装包双击即可;Linux 双击 AppImage 直接运行(root 用户起不来的话,终端里加--no-sandbox参数执行)。
客户端启动后能看到带 Create Video 和 Create Avatar 入口的主界面,后面传素材、贴文案都在这里进行:
踩坑自救:最常见的 3 个卡点
| 现象 | 最可能的原因 | 解法 |
|---|---|---|
| 卡在镜像拉取、速度慢 | 没配加速源或镜像源失效 | Docker Engine 里加 registry-mirrors 并重启,重新跑docker-compose up -d |
| 容器起不来、反复重启 | 没装英伟达驱动或显存不足 | nvidia-smi确认驱动;显存不够就换 lite 版 |
| 18180/10095/8383 端口冲突 | 本地其他应用占了端口 | 改 deploy/docker-compose.yml 里冒号前的宿主机端口号 |
⚠️ 求助前保持一个习惯:服务端和客户端都更新到最新版,重新
docker-compose up -d一遍再试,多数问题新版已经修了。
查日志定位真实原因
表格没命中的时候,最后一步永远是看日志:Docker Desktop 打开 Logs 页签,找到没 Running 的那个容器,最后几行就是真实报错。同类问题也可以翻 doc/常见问题.md:
跑起来之后:先干这 3 件事
- 克隆你的数字人:录 10 秒出镜视频(正对镜头、不遮挡、声音清晰),传到 Create Avatar,它从这段视频里提取你的形象和音色,生成一个可反复用的模型
- 生成口播视频:进 Create Video,选模型、贴文案,它先用你的声音合成音频,再驱动数字人口型,输出一条成片
- 管理作品和模型:成片和模型都在 My Works / My Avatars 两个标签页,支持多个模型并存,按需切换
现在就打开客户端,录一段 10 秒的出镜视频丢进 Create Avatar;克隆完成后,把一段 100 字的文案贴进 Create Video,看"你"开不开口——开口了,这条链路就通了。
【免费下载链接】Duix-Avatar🚀 Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考