☰
Duix.Avatar 数字人本地部署:30分钟跑通全离线口播视频生成
2026/10/1 5:35:55 网站建设 项目流程

Duix.Avatar 数字人本地部署:30分钟跑通全离线口播视频生成

【免费下载链接】Duix-Avatar🚀 Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar

Duix.Avatar 是一款全离线运行的数字人视频合成工具:上传一段约 10 秒的视频,即可克隆你的形象和声音,再输入文案或音频,就能生成口型对得上的口播视频,全程本地完成。本文带你走一遍 Duix.Avatar 本地部署的完整路径:硬件自检、拉取源码、Docker 服务启动、客户端验证,30 分钟从零跑通。

环境自检:确认硬件与前置软件

Duix.Avatar 的 AI 算力全部在本地跑,硬件不到线,服务起不来。动手前先对照这张表:

硬件项最低要求推荐配置
操作系统Windows 10(19042+)或 Ubuntu 22.04Windows 11 或 Ubuntu 22.04 Desktop
内存32GB(必要)32GB 及以上
磁盘C 盘 100G+ 空闲(镜像)、D 盘 30G+ 空闲(数据)150G 以上连续空闲
显卡NVIDIA 显卡并装好驱动(必要)RTX 4070
CPU六核及以上13代 i5-13400F

⚠️ 配置卡在最低线附近时,先关掉占内存的大应用再动手,三个服务容器会占满大部分内存。

前置软件按顺序备齐,共 4 项:

  • NVIDIA 显卡驱动— 全部算力都在本地 GPU 上,没驱动容器起不来,用nvidia-smi能打印显卡信息即算装好
  • WSL— Windows 上 Docker Desktop 依赖的子系统,提前装好
  • Docker Desktop— 承载语音识别、语音合成、视频合成三个服务容器
  • Git— 拉取 Duix.Avatar 项目源码

分步落地:五步完成 Duix.Avatar 本地部署

🔧 拉取项目源码并进入目录

这一步把项目完整下载到本地,服务端部署配置都在deploy/目录里。

git clone https://gitcode.com/GitHub_Trending/he/Duix-Avatar cd Duix-Avatar

做完后,当前目录下应能看到src/、deploy/、README_zh.md等文件。

🔧 配置 WSL 与 Docker 资源配额

这一步为 Docker 打好 Windows 侧的基础:装好 WSL 后,把 Docker 可用内存设到 32GB、CPU 至少 4 核;C 盘空闲不足 100G 时,在 Resources 页用 Browse 把镜像存储位置挪到更大的盘。

wsl --install wsl --update

做完后打开 Docker Desktop,底部状态栏应显示 Engine running。

🔧 配置镜像加速源避免拉取过慢

这一步解决镜像拉取慢的问题。三个服务镜像合计约 70G,不加速可能要好几个小时。打开 Docker Desktop 的 Settings > Docker Engine,在配置中加入registry-mirrors字段,点击 Apply & restart。

{ "registry-mirrors": [ "https://docker.1ms.run", "https://docker.m.daocloud.io" ] }

做完后 Docker 会自动重启,之后拉镜像的速度明显变快。

⚠️ 镜像源会随时间失效,如果上面的地址拉不动,自行搜索当前可用的 registry-mirrors 替换。

🔧 拉取三个服务镜像并后台启动

这一步是 Duix.Avatar 本地部署的核心:一条命令拉起语音识别(fun-asr)、语音合成(fish-speech)、视频合成(duix.avatar)三个服务。

cd deploy docker-compose up -d

做完后需要耐心等待:约 70G 镜像下载,网速好时半小时左右。完成后执行docker compose ps,应看到三个服务全部 Running。

  • 50 系列显卡(如 5090)用户改用docker-compose -f docker-compose-5090.yml up -d
  • Ubuntu 用户改用docker-compose -f docker-compose-linux.yml up -d

🔧 安装或构建桌面客户端

这一步装操作界面。两种方式:从项目 Releases 页下载官方安装包双击安装;或本地从源码构建,需先装好 Node.js 18。

npm install npm run build:win

做完后,构建产物中会生成客户端安装包;或双击下载的Duix.Avatar-x.x.x-setup.exe完成安装。

验收与排障:验证 Duix.Avatar 本地部署并快速定位问题

✅ 三步确认装好:

  1. 在deploy/目录执行docker compose ps,三个服务均显示 Running
  2. 双击打开客户端,首页出现 Create Video / Create Avatar 入口和 My Works、My Avatars 列表
  3. 点 Create Avatar 上传一段 10 秒左右的口播视频,等待克隆任务完成

没装好或卡住时,先对照这张表:

症状可能原因解法
容器启动后立即退出NVIDIA 驱动未装好或未生效重装驱动,用nvidia-smi确认能打印显卡信息
镜像拉取极慢镜像加速未生效检查 registry-mirrors 配置后重启 Docker
C 盘写满 Docker 起不来镜像目录超出空闲空间Settings > Resources 中把镜像位置挪到别的盘
服务 Running 但上传无响应端口被占用或服务端版本旧关闭占用程序;重新执行docker-compose up -d更新服务端
生成视频缓慢或中断内存争抢关闭其他大应用,检查 Docker 内存配额

都没命中就翻两端日志:客户端日志在右上角 Settings > 打开日志,文件位于 AppData 下的logs/目录;服务端日志在 Docker 里点进对应容器,切到 Logs 标签查看。

仍无法定位,就去常见问题里查,或按报错原文检索项目 Issue 列表。

功能速览:上手三件事与进阶玩法

上手三件事:

  • 创建数字人— 上传一段 10 秒口播视频,克隆出形象和声音,得到一个能直接驱动的数字分身
  • 文字转视频— 输入文案、选中数字人,生成口型自然对齐的口播视频,可立即播放回看
  • 管理作品— 视频和形象归档在 My Works / My Avatars,支持按名称搜索、随时删除

进阶可玩:

  • 音频直接驱动— 跳过文字合成,用自己的录音驱动数字人,口型跟着原录音节奏走
  • 直接调用 API— Docker 启动后本地暴露模特训练、音频合成、视频合成接口,可在自己的代码里对接,参考实现见 src/main/service/
  • 多语言文案— 脚本支持中、英、日、法、德等八种语言,一次配置多语出片

做产品讲解视频、企业内部培训播报或自媒体短视频批量生产时,Duix.Avatar 都能在本地机器上直接开工,数据不用出内网。

【免费下载链接】Duix-Avatar🚀 Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

需要专业的网站建设服务?

联系我们获取免费的网站建设咨询和方案报价,让我们帮助您实现业务目标

立即咨询