Duix.Avatar 数字人本地部署:10分钟搭好服务端与客户端,跑通第一段口播视频
【免费下载链接】Duix-Avatar🚀 Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar
装好工具、点开客户端却卡在生成——这是新手在 Duix.Avatar 上最常卡住的环节。Duix.Avatar 是一款支持本地离线部署的 AI 数字人视频生成工具,能克隆形象和声音,用文字或语音驱动数字人自动对口型出片。本文带你从零跑通:搭服务端、装客户端,生成第一段口播视频。
一句话定义与核心能力
Duix.Avatar 是一款全离线运行的数字人视频合成工具:它先克隆你的外貌与声音,再把文字或语音变成数字人说话的画面,全程不依赖联网。
- 外貌与声音克隆:上传一段约 10 秒的视频,克隆出可复用的数字人形象与音色
- 文字/语音驱动:输入文案或上传音频,即可驱动数字人开口说话
- 视频合成:口型与声音自动对齐,直接产出可播放的口播视频
- 多语言:脚本支持中、英、日、韩、法、德、阿拉伯、西语八种语言
安装前的前置条件自查
动手前先逐项确认,缺一项都可能导致服务起不来:
- 系统:Windows 10 19042.1526 及以上,或 Ubuntu 22.04 桌面版
- 内存:32GB 及以上(必要,16G 可能起不动)
- 显卡:NVIDIA 显卡,且驱动已装好,
nvidia-smi能正常显示显卡 - 磁盘:C 盘空闲 >100G(存 Docker 镜像),D 盘(或数据盘)>30G(存数字人与作品)
- 网络:能访问 Docker Hub,首次拉镜像约 70G 流量,建议连 WiFi
- Node.js 18:从源码运行客户端时需要
部署步骤:首次跑通最短路径
- 拉源码。执行下面命令,本地得到
deploy/和src/两个目录。git clone https://gitcode.com/GitHub_Trending/he/HeyGem.ai cd HeyGem.ai - 起服务端。进入
deploy目录执行,后台开始拉 3 个镜像,约半小时。cd deploy docker-compose up -d只想试跑视频合成时,可换 lite 版:
docker-compose -f docker-compose-lite.yml up -d(只起一个服务)。 - 装客户端。Windows 下下载官方安装包,双击
Duix.Avatar-x.x.x-setup.exe完成安装;用源码跑则先npm install,再npm run dev。 - C 盘不足 100G 时,在 Docker 设置里把 Disk image location 改到空间充足的盘,Apply & restart 后重新拉取。
跑通验证:怎么判断成功了
判断标准只有一条:Docker 里三个服务都处于 Running(lite 版只有duix-avatar-gen-video一个)。逐项对照下表核对:
| 检查项 | 正常表现 | 异常表现 |
|---|---|---|
| 服务端 | 3 个容器状态 Running,端口 18180 / 10095 / 8383 已监听 | 容器反复重启、显示 Error 或卡在 Created |
| 显卡 | nvidia-smi正常列出显卡型号 | 无输出或报错,三个服务起不来 |
| 客户端 | 打开首页,能创建 Avatar / 能生成 Video | 生成报错、连不上服务端 |
| 端口 | 浏览器访问http://127.0.0.1:8383有响应 | Connection refused |
看服务端日志可在 Docker 容器里点开 Logs 标签页复制,用于排查。
核心功能试玩
功能一:克隆数字人形象与声音
- 目标:把你的形象和声音做成可复用的模特
- 操作:客户端点 Create Avatar,上传一段约 10 秒、含清晰人声口播的视频,等待训练完成
- 结果:My Avatars 列表出现一个新模特,同时拥有形象和音色
功能二:生成口播视频
- 目标:让克隆好的数字人念一段文案
- 操作:Create Video,选中模特,输入文案(或上传音频),提交生成
- 结果:My Works 列表出现新视频,可播放,口型与语音对齐
功能三:管理模特与作品
- 目标:复用或清理已生成的内容
- 操作:在 My Avatars / My Works 两个标签页切换,删除或重命名条目
- 结果:按创作需求挑选合适模特,管理历史作品
坑与自救
坑 1:拉镜像报net/http: request canceled/context canceled
- 现象:
docker-compose up -d三个服务同时报连接超时 - 可能原因:Docker Hub 官方源连不稳
- 修复:在 Docker Engine 配置里加
registry-mirrors镜像源,Apply & restart
坑 2:克隆模特时报错,日志里出现Connection refused(asr)
- 现象:形象克隆失败,TTS/ASR 日志报连接被拒
- 可能原因:
Duix.Avatar-asr启动较慢,或内存不足(16G 可能起不来) - 修复:服务端启动后等几分钟再克隆;内存不够则升级到 32G
坑 3:新增模特直接报错
- 现象:上传视频创建模特时提示失败
- 可能原因:模特视频没有声音,或不是人在说话
- 修复:换一段有清晰人声、且是真人说话的视频重新上传
收尾
Duix.Avatar 的本地部署就三条线:服务端起满三个容器、客户端装上能打开、克隆加生成各跑通一次。下一步可以这样走:
- 进阶配置:50 系列显卡改用
docker-compose-5090.yml;显存紧张时换 lite 版只跑视频合成 - 扩展功能:按 Open API 里模型训练、语音合成、视频合成三个接口做二次开发
- 官方资料:查阅 官方文档 与 客户端核心模块 定位服务逻辑
【免费下载链接】Duix-Avatar🚀 Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考