Duix.Avatar 数字人本地部署:30分钟跑通全离线口播视频生成
【免费下载链接】Duix-Avatar🚀 Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar
Duix.Avatar 是一款全离线运行的数字人视频合成工具:上传一段约 10 秒的视频,即可克隆你的形象和声音,再输入文案或音频,就能生成口型对得上的口播视频,全程本地完成。本文带你走一遍 Duix.Avatar 本地部署的完整路径:硬件自检、拉取源码、Docker 服务启动、客户端验证,30 分钟从零跑通。
环境自检:确认硬件与前置软件
Duix.Avatar 的 AI 算力全部在本地跑,硬件不到线,服务起不来。动手前先对照这张表:
| 硬件项 | 最低要求 | 推荐配置 |
|---|---|---|
| 操作系统 | Windows 10(19042+)或 Ubuntu 22.04 | Windows 11 或 Ubuntu 22.04 Desktop |
| 内存 | 32GB(必要) | 32GB 及以上 |
| 磁盘 | C 盘 100G+ 空闲(镜像)、D 盘 30G+ 空闲(数据) | 150G 以上连续空闲 |
| 显卡 | NVIDIA 显卡并装好驱动(必要) | RTX 4070 |
| CPU | 六核及以上 | 13代 i5-13400F |
⚠️ 配置卡在最低线附近时,先关掉占内存的大应用再动手,三个服务容器会占满大部分内存。
前置软件按顺序备齐,共 4 项:
- NVIDIA 显卡驱动— 全部算力都在本地 GPU 上,没驱动容器起不来,用
nvidia-smi能打印显卡信息即算装好 - WSL— Windows 上 Docker Desktop 依赖的子系统,提前装好
- Docker Desktop— 承载语音识别、语音合成、视频合成三个服务容器
- Git— 拉取 Duix.Avatar 项目源码
分步落地:五步完成 Duix.Avatar 本地部署
🔧 拉取项目源码并进入目录
这一步把项目完整下载到本地,服务端部署配置都在deploy/目录里。
git clone https://gitcode.com/GitHub_Trending/he/Duix-Avatar cd Duix-Avatar做完后,当前目录下应能看到src/、deploy/、README_zh.md等文件。
🔧 配置 WSL 与 Docker 资源配额
这一步为 Docker 打好 Windows 侧的基础:装好 WSL 后,把 Docker 可用内存设到 32GB、CPU 至少 4 核;C 盘空闲不足 100G 时,在 Resources 页用 Browse 把镜像存储位置挪到更大的盘。
wsl --install wsl --update做完后打开 Docker Desktop,底部状态栏应显示 Engine running。
🔧 配置镜像加速源避免拉取过慢
这一步解决镜像拉取慢的问题。三个服务镜像合计约 70G,不加速可能要好几个小时。打开 Docker Desktop 的 Settings > Docker Engine,在配置中加入registry-mirrors字段,点击 Apply & restart。
{ "registry-mirrors": [ "https://docker.1ms.run", "https://docker.m.daocloud.io" ] }做完后 Docker 会自动重启,之后拉镜像的速度明显变快。
⚠️ 镜像源会随时间失效,如果上面的地址拉不动,自行搜索当前可用的 registry-mirrors 替换。
🔧 拉取三个服务镜像并后台启动
这一步是 Duix.Avatar 本地部署的核心:一条命令拉起语音识别(fun-asr)、语音合成(fish-speech)、视频合成(duix.avatar)三个服务。
cd deploy docker-compose up -d做完后需要耐心等待:约 70G 镜像下载,网速好时半小时左右。完成后执行docker compose ps,应看到三个服务全部 Running。
- 50 系列显卡(如 5090)用户改用
docker-compose -f docker-compose-5090.yml up -d - Ubuntu 用户改用
docker-compose -f docker-compose-linux.yml up -d
🔧 安装或构建桌面客户端
这一步装操作界面。两种方式:从项目 Releases 页下载官方安装包双击安装;或本地从源码构建,需先装好 Node.js 18。
npm install npm run build:win做完后,构建产物中会生成客户端安装包;或双击下载的Duix.Avatar-x.x.x-setup.exe完成安装。
验收与排障:验证 Duix.Avatar 本地部署并快速定位问题
✅ 三步确认装好:
- 在
deploy/目录执行docker compose ps,三个服务均显示 Running - 双击打开客户端,首页出现 Create Video / Create Avatar 入口和 My Works、My Avatars 列表
- 点 Create Avatar 上传一段 10 秒左右的口播视频,等待克隆任务完成
没装好或卡住时,先对照这张表:
| 症状 | 可能原因 | 解法 |
|---|---|---|
| 容器启动后立即退出 | NVIDIA 驱动未装好或未生效 | 重装驱动,用nvidia-smi确认能打印显卡信息 |
| 镜像拉取极慢 | 镜像加速未生效 | 检查 registry-mirrors 配置后重启 Docker |
| C 盘写满 Docker 起不来 | 镜像目录超出空闲空间 | Settings > Resources 中把镜像位置挪到别的盘 |
| 服务 Running 但上传无响应 | 端口被占用或服务端版本旧 | 关闭占用程序;重新执行docker-compose up -d更新服务端 |
| 生成视频缓慢或中断 | 内存争抢 | 关闭其他大应用,检查 Docker 内存配额 |
都没命中就翻两端日志:客户端日志在右上角 Settings > 打开日志,文件位于 AppData 下的logs/目录;服务端日志在 Docker 里点进对应容器,切到 Logs 标签查看。
仍无法定位,就去常见问题里查,或按报错原文检索项目 Issue 列表。
功能速览:上手三件事与进阶玩法
上手三件事:
- 创建数字人— 上传一段 10 秒口播视频,克隆出形象和声音,得到一个能直接驱动的数字分身
- 文字转视频— 输入文案、选中数字人,生成口型自然对齐的口播视频,可立即播放回看
- 管理作品— 视频和形象归档在 My Works / My Avatars,支持按名称搜索、随时删除
进阶可玩:
- 音频直接驱动— 跳过文字合成,用自己的录音驱动数字人,口型跟着原录音节奏走
- 直接调用 API— Docker 启动后本地暴露模特训练、音频合成、视频合成接口,可在自己的代码里对接,参考实现见 src/main/service/
- 多语言文案— 脚本支持中、英、日、法、德等八种语言,一次配置多语出片
做产品讲解视频、企业内部培训播报或自媒体短视频批量生产时,Duix.Avatar 都能在本地机器上直接开工,数据不用出内网。
【免费下载链接】Duix-Avatar🚀 Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考