HeyGem.ai(Duix.Avatar)版本更新纪要:1.0.6 新增 Ubuntu 部署、5090 支持,附 4 个 Compose 方案选型
【免费下载链接】Duix-Avatar🚀 Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar
本文基于 HeyGem.ai(项目名 Duix.Avatar)仓库材料整理,覆盖 1.0 系列开源至当前 1.0.6 的变更点(Ubuntu 22.04、NVIDIA 50 系显卡、客户端英文界面),并给出 4 套部署方案的选型与升级步骤。
📌 1.0.6 的变更点有 3 项,逐条核对
README.md 开头的"What's New"通知只有两条——Nvidia 50 系显卡版本通知与新增 Ubuntu 版本通知,结合 package.json 中的版本号 1.0.6,此次更新实际包含 4 个变更点:
- Ubuntu 版本正式发布:完成 Ubuntu 22.04 Desktop(内核 6.8.0-52-generic)的适配验证,其他 Linux 版本暂未测试。
- NVIDIA 50 系显卡支持:基于 5090 测试通过;30/40 系显卡用户升级 CUDA 12.8 后也可采用该方案;5090 方案使用 PyTorch 官方预览版。
- 客户端国际化:客户端程序界面补充英文。
- 已知问题修复:GitHub issue #304、#292。
新旧差异如下,每行均对应仓库内文件,便于对照核查:
| 能力维度 | 1.0 早期版本 | 当前版本(1.0.6) | 仓库出处 |
|---|---|---|---|
| 服务端系统 | 仅 Windows 10 | 新增 Ubuntu 22.04 Desktop(内核 6.8.0-52-generic) | README_zh.md、deploy/docker-compose-linux.yml |
| NVIDIA 显卡 | 30/40 系 | 新增 50 系(5090 实测,PyTorch 官方预览版) | README.md、deploy/docker-compose-5090.yml |
| 客户端语言 | 仅中文 | 中文 + 英文 | README.md「新增 Ubuntu 版本通知」 |
| 已知问题 | 存在 #304、#292 | 已修复 | README.md「What's New」 |
| 客户端形态 | Windows 安装包 | Windows .exe + Linux AppImage(免安装) | electron-builder.yml |
🧩 4 套部署方案:deploy 目录下每个 compose 文件的服务与端口
deploy/ 目录下共有 4 个 compose 文件。Compose 是 Docker 的容器编排描述文件,一条up -d命令即可拉起全部服务,四套方案的差别在于服务数量与镜像版本:
| 方案 | compose 文件 | 服务构成 | 本地端口 | 适用场景 |
|---|---|---|---|---|
| Windows 标准 | docker-compose.yml | 3 个:TTS 语音合成 + ASR 语音识别 + 视频合成 | 18180 / 10095 / 8383 | 30/40 系显卡 |
| Windows 轻量 | docker-compose-lite.yml | 1 个:仅视频合成(Duix.Avatar-gen-video) | 8383 | 只需要视频合成环节 |
| 50 系显卡 | docker-compose-5090.yml | 2 个:TTS(5090 镜像)+ 视频合成(5090 镜像),不含 ASR | 18180 / 8383 | 5090;30/40 系 + CUDA 12.8 亦可用 |
| Ubuntu | docker-compose-linux.yml | 3 个:同标准方案 | 18180 / 10095 / 8383 | Ubuntu 22.04 |
两个容易忽略的细节:
- 5090 方案把镜像替换为
guiji2025/fish-speech-5090与guiji2025/duix.avatar-5090,且不启动 ASR(fun-asr)服务;而 TTS 服务在"模特训练"环节依赖 ASR 做语音识别(见 doc/常见问题.md 中的 Connection refused 排错记录),做声音克隆前需确认语音识别环节可用。 - Windows 方案把数据目录挂载到
D:\duix_avatar_data,Linux 方案挂载到~/duix_avatar_data,该路径是与容器内部约定的,修改需同步改 compose 文件。
部署前的硬件与磁盘空间自查
README 给出的硬性要求与推荐配置:
- 必须有 NVIDIA 显卡且驱动安装正确——本项目所有算力在本地,没有显卡或驱动时服务无法启动。
- 推荐配置:i5-13400F、内存 32G 及以上(必要)、RTX 4070。
- Windows 用户另需:D 盘空闲 30GB 以上(存放数字人与作品数据),C 盘 100GB 以上(存放 Docker 镜像,不足时可在 Docker Desktop 设置中把镜像目录改到空间更大的盘)。
- 首次部署下载流量约 70GB,README 提示建议在 WiFi 环境下预留半小时左右。
🔧 1.0.x 升级到 1.0.6:服务端拉镜像、客户端重装
服务端:重新执行 compose 拉取新镜像
服务端完全由 Docker 镜像构成,升级即拉取新镜像并重启。doc/常见问题.md 中的标准更新动作就是"到 /deploy 目录重新执行docker-compose up -d"。尚未拉取代码时的完整步骤:
git clone https://gitcode.com/GitHub_Trending/he/HeyGem.ai cd HeyGem.ai/deploy docker-compose up -d5090 用户将命令替换为:
cd deploy docker-compose -f docker-compose-5090.yml up -d轻量方案同理使用-f docker-compose-lite.yml。启动后在 Docker 中看到 3 个 Running 状态的服务即成功(轻量方案为 1 个)。
客户端:exe 安装包或 AppImage
- Windows:安装官方构建的
Duix.Avatar-x.x.x-setup.exe;项目内置 electron-updater 自动更新模块,配置见 dev-app-update.yml。 - Ubuntu:双击
Duix.Avatar-x.x.x.AppImage即可启动,无需安装;以 root 用户登录桌面时双击可能无效,需在终端执行./Duix.Avatar-x.x.x.AppImage --no-sandbox。 - 若需从源码构建客户端,依赖 Node.js 18。
故障排查:3 项自查与 2 个日志入口
服务起不来或创建模特报错时先查的 3 项
- 服务是否全部处于 Running 状态(标准/Linux 方案 3 个、轻量 1 个、5090 方案 2 个)?
nvidia-smi是否显示显卡信息?驱动未安装是最常见的启动失败原因。- 服务端与客户端是否都更新到最新版本?项目更新频繁,问题可能已在新版修复。
doc/常见问题.md 中还有两个高频问题:
- 拉镜像报连接超时:在
/etc/docker/daemon.json中配置registry-mirrors国内镜像源,文档内附可直接使用的示例。 - 新增模特时报错:用于创建模特的视频必须有人声且是人在说话,程序要用这段声音做声音克隆,无声视频不可用。
客户端与服务端日志的查看位置
- 客户端日志:
%AppData%\heygem.ai\logs下的main.log,可通过客户端"设置—打开日志"入口直接打开。 - 服务端日志:在 Docker Desktop 中点开对应服务查看输出;镜像名分别为
guiji2025/fish-speech-ziming(TTS)、guiji2025/fun-asr(ASR)、guiji2025/duix.avatar(视频合成)。 - 日志出现
Connection refused时,重点确认 10095 端口的 ASR 服务是否启动成功。
不想买 GPU 的路径:Coze 平台直接使用数字人克隆
README 中给出了本地部署与 API 服务的对照表:本地部署适合希望深度定制、可修改代码的技术型用户;API 服务无需购买 GPU 服务器、维护简单,但无法修改源码,仅能通过接口扩展。此外,项目已在 Coze 平台上线数字人克隆智能体与插件,无需本地部署即可体验:
选择本地部署时还有一个许可细节:开源版本支持全球免费商用,但用户量超过 10 万或年营收超过 1000 万美元的企业需签署商业许可协议,协议全文见仓库根目录的 Duix.Avatar model community Licensing Agreement.pdf。
下一步
以上变更点均出自 README 通知、package.json 与 deploy/ 配置,进一步可查阅:
- 部署与升级完整步骤:README_zh.md
- 4 套方案配置文件:deploy/
- 拉镜像失败、创建模特报错等排错:doc/常见问题.md
【免费下载链接】Duix-Avatar🚀 Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考