Duix-Avatar 安装指南:4 步从零跑通离线虚拟形象视频合成
【免费下载链接】Duix-Avatar🚀 Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar
Duix-Avatar 是一款开源的虚拟形象视频合成工具:上传一段你说话的录像,它能克隆你的长相和音色,生成口型对得上的说话视频。整个流程跑在本地,不依赖外网,素材不会离开你的电脑。本文带你按零基础路线完成安装:先体检环境,再走部署,全程约 40 分钟。
环境体检:安装前先确认这三件事
先看硬件。下表是最低线和舒适线,低于最低线的机器直接跑不起来:
| 检查项 | 最低要求 | 推荐配置 |
|---|---|---|
| 操作系统 | Windows 10(19042 以上)或 Ubuntu 22.04 | Windows 11 / Ubuntu 22.04 桌面版 |
| 处理器 | 四核 CPU | i5-13400F 及以上 |
| 内存 | 16GB | 32GB |
| 磁盘空间 | 系统盘 100GB + 数据盘 30GB 空闲 | 150GB 以上 |
| 显卡 | NVIDIA 独显,驱动已装好 | RTX 4070 及以上 |
⚠️ 最容易踩的坑:三个服务全靠本地 NVIDIA 显卡算力驱动。没有 N 卡或驱动没装好,服务根本起不来,集显机器做不了视频合成。
软件层面要预装三样,各一句话:
- Git—— 拉取项目源码用。
- Docker Desktop—— 容器化部署 TTS、ASR、视频合成三类服务,Windows 下依赖 WSL 子系统。
- NVIDIA 显卡驱动—— 给容器分配 GPU 算力,装完执行
nvidia-smi,能打印显卡信息即通过。
检查完,先睹一眼最终效果:
部署实操:Docker 配置分 5 步完成
拉取项目源码
后续操作都在项目目录里进行,先把它拿下来:
git clone https://gitcode.com/GitHub_Trending/he/Duix-Avatar cd Duix-Avatar做完后目录里应能看到deploy和src两个文件夹,服务编排文件就在 deploy/ 中。
检查 WSL 并分配 Docker 资源
为什么做:Windows 的 Docker 跑在 WSL 上,子系统版本过旧会装不上;镜像体量大,默认磁盘位置空间不足会直接失败。
- 执行
wsl --list --verbose查看 WSL,没装则先执行wsl --update更新。 - 打开 Docker Desktop,点右上角齿轮进入设置。
- 左侧进入Resources → Advanced,在Disk image location旁点 Browse,把存储路径改到剩余空间 100GB 以上的磁盘。
- 给 WSL 分配至少 8GB 内存、4 个 CPU 核心。
- 点底部Apply & restart生效。
做完后窗口左下角应显示绿色的 Engine running。
配置 Docker 国内镜像源
为什么做:Docker Hub 官方源拉取经常超时,换镜像源能省掉半小时的等待。
- 在设置页左侧点Docker Engine。
- 在 JSON 配置中加入下面一段,点Apply & restart:
{ "registry-mirrors": ["https://docker.1ms.run"] }数组里可以多加几个地址做冗余,任意一个可用即可。
一键启动容器服务
为什么做:一条命令拉起声音克隆、语音识别、视频合成三个后端。
cd deploy docker-compose up -d首次运行要下载镜像和模型,流量约 70GB,预留 20-40 分钟。机器内存只有 16GB 时,改用docker-compose -f docker-compose-lite.yml up -d只起一个合成服务;Ubuntu 22.04 用户用 apt 装好 Docker 后,在同目录执行docker-compose -f docker-compose-linux.yml up -d。
做完后容器页面应显示 3 个 Running 状态的容器。
安装桌面客户端
为什么做:容器是后端大脑,客户端才是你操作的界面。
- 到项目官方发布页下载 Windows 安装包。
- 双击
Duix.Avatar-x.x.x-setup.exe完成安装。 - 双击桌面快捷方式启动。
客户端会自动连上本地三个服务,无需额外配置。
启动验证:怎么判断装好了
打开客户端,看到首页出现"Create Video"和"Create Avatar"两张入口卡片,部署就算完成。
正式开玩前,建议跑一遍冒烟测试:
- 点Create Avatar,上传一段人在说话、时长 20 秒以上的视频,完成第一个形象模型。
- 进入Create Video,选中该模型,输入一句话文案,生成一段 10 秒左右的测试视频。
- 确认新作品出现在 My Works 列表,并能正常播放。
⚠️ 数据处理全程在本地,但仍别处理敏感素材;视频合成吃满显卡,渲染时关掉其他占资源的应用;产出默认存放在
d:/duix_avatar_data,定期清理。
故障速查:常见卡点对照表
进入deploy目录,先查状态和日志:
docker-compose ps docker-compose logs| 现象 | 可能原因 | 处理动作 |
|---|---|---|
| 容器起不来、秒退 | 无 N 卡或驱动缺失 | 装驱动,nvidia-smi验证 |
| 启动报 registry 连接超时 | 官方源拉取慢 | 配置国内镜像源后重跑 |
| 创建形象报 Connection refused | asr 服务还在冷启动 | 启动后等 3-5 分钟再试 |
| 新增模特报错 | 视频无声或无人说话 | 换人在说话的录像重传 |
客户端侧的问题,进右上角设置菜单点Open Log,日志文件在用户目录logs下的main.log;服务端日志则在对应容器的 Logs 页直接看。
更多排查步骤见官方自查清单 doc/常见问题.md;服务端口(18180 / 8383 / 10095)与数据目录改法都在 deploy/docker-compose.yml 里。
功能导览:新手三件套与进阶玩法
新手三件套:
- 创建第一个虚拟形象—— 上传说话视频,系统自动克隆外观和声音。你会看到模型出现在 My Avatars 列表里。
- 文字驱动视频—— 输入文案、选形象和音色,一键生成。你会得到一段形象开口说话、口型同步的视频。
- 作品管理—— 生成的视频都落在 My Works,随时回放和导出。作品列表会带时间戳实时更新。
进阶玩法:
- 多模型导入,一键切换
- 八国语言文案支持
- 音色参数自定义
- 开放接口二次开发
无论是课程录制、产品带货,还是短视频口播和培训资料,都能在这台本地机器上离线产出。
【免费下载链接】Duix-Avatar🚀 Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考