news 2026/9/11 16:13:50

HeyGem.ai(Duix.Avatar)版本更新纪要:1.0.6 新增 Ubuntu 部署、5090 支持,附 4 个 Compose 方案选型

作者头像

张小明

前端开发工程师

1.2k 24
文章封面图
HeyGem.ai(Duix.Avatar)版本更新纪要:1.0.6 新增 Ubuntu 部署、5090 支持,附 4 个 Compose 方案选型

HeyGem.ai(Duix.Avatar)版本更新纪要:1.0.6 新增 Ubuntu 部署、5090 支持,附 4 个 Compose 方案选型

【免费下载链接】Duix-Avatar🚀 Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar

本文基于 HeyGem.ai(项目名 Duix.Avatar)仓库材料整理,覆盖 1.0 系列开源至当前 1.0.6 的变更点(Ubuntu 22.04、NVIDIA 50 系显卡、客户端英文界面),并给出 4 套部署方案的选型与升级步骤。

📌 1.0.6 的变更点有 3 项,逐条核对

README.md 开头的"What's New"通知只有两条——Nvidia 50 系显卡版本通知与新增 Ubuntu 版本通知,结合 package.json 中的版本号 1.0.6,此次更新实际包含 4 个变更点:

  1. Ubuntu 版本正式发布:完成 Ubuntu 22.04 Desktop(内核 6.8.0-52-generic)的适配验证,其他 Linux 版本暂未测试。
  2. NVIDIA 50 系显卡支持:基于 5090 测试通过;30/40 系显卡用户升级 CUDA 12.8 后也可采用该方案;5090 方案使用 PyTorch 官方预览版。
  3. 客户端国际化:客户端程序界面补充英文。
  4. 已知问题修复:GitHub issue #304、#292。

新旧差异如下,每行均对应仓库内文件,便于对照核查:

能力维度1.0 早期版本当前版本(1.0.6)仓库出处
服务端系统仅 Windows 10新增 Ubuntu 22.04 Desktop(内核 6.8.0-52-generic)README_zh.md、deploy/docker-compose-linux.yml
NVIDIA 显卡30/40 系新增 50 系(5090 实测,PyTorch 官方预览版)README.md、deploy/docker-compose-5090.yml
客户端语言仅中文中文 + 英文README.md「新增 Ubuntu 版本通知」
已知问题存在 #304、#292已修复README.md「What's New」
客户端形态Windows 安装包Windows .exe + Linux AppImage(免安装)electron-builder.yml

🧩 4 套部署方案:deploy 目录下每个 compose 文件的服务与端口

deploy/ 目录下共有 4 个 compose 文件。Compose 是 Docker 的容器编排描述文件,一条up -d命令即可拉起全部服务,四套方案的差别在于服务数量与镜像版本:

方案compose 文件服务构成本地端口适用场景
Windows 标准docker-compose.yml3 个:TTS 语音合成 + ASR 语音识别 + 视频合成18180 / 10095 / 838330/40 系显卡
Windows 轻量docker-compose-lite.yml1 个:仅视频合成(Duix.Avatar-gen-video)8383只需要视频合成环节
50 系显卡docker-compose-5090.yml2 个:TTS(5090 镜像)+ 视频合成(5090 镜像),不含 ASR18180 / 83835090;30/40 系 + CUDA 12.8 亦可用
Ubuntudocker-compose-linux.yml3 个:同标准方案18180 / 10095 / 8383Ubuntu 22.04

两个容易忽略的细节:

  • 5090 方案把镜像替换为guiji2025/fish-speech-5090guiji2025/duix.avatar-5090,且不启动 ASR(fun-asr)服务;而 TTS 服务在"模特训练"环节依赖 ASR 做语音识别(见 doc/常见问题.md 中的 Connection refused 排错记录),做声音克隆前需确认语音识别环节可用。
  • Windows 方案把数据目录挂载到D:\duix_avatar_data,Linux 方案挂载到~/duix_avatar_data,该路径是与容器内部约定的,修改需同步改 compose 文件。

部署前的硬件与磁盘空间自查

README 给出的硬性要求与推荐配置:

  • 必须有 NVIDIA 显卡且驱动安装正确——本项目所有算力在本地,没有显卡或驱动时服务无法启动。
  • 推荐配置:i5-13400F、内存 32G 及以上(必要)、RTX 4070。
  • Windows 用户另需:D 盘空闲 30GB 以上(存放数字人与作品数据),C 盘 100GB 以上(存放 Docker 镜像,不足时可在 Docker Desktop 设置中把镜像目录改到空间更大的盘)。
  • 首次部署下载流量约 70GB,README 提示建议在 WiFi 环境下预留半小时左右。

🔧 1.0.x 升级到 1.0.6:服务端拉镜像、客户端重装

服务端:重新执行 compose 拉取新镜像

服务端完全由 Docker 镜像构成,升级即拉取新镜像并重启。doc/常见问题.md 中的标准更新动作就是"到 /deploy 目录重新执行docker-compose up -d"。尚未拉取代码时的完整步骤:

git clone https://gitcode.com/GitHub_Trending/he/HeyGem.ai cd HeyGem.ai/deploy docker-compose up -d

5090 用户将命令替换为:

cd deploy docker-compose -f docker-compose-5090.yml up -d

轻量方案同理使用-f docker-compose-lite.yml。启动后在 Docker 中看到 3 个 Running 状态的服务即成功(轻量方案为 1 个)。

客户端:exe 安装包或 AppImage

  • Windows:安装官方构建的Duix.Avatar-x.x.x-setup.exe;项目内置 electron-updater 自动更新模块,配置见 dev-app-update.yml。
  • Ubuntu:双击Duix.Avatar-x.x.x.AppImage即可启动,无需安装;以 root 用户登录桌面时双击可能无效,需在终端执行./Duix.Avatar-x.x.x.AppImage --no-sandbox
  • 若需从源码构建客户端,依赖 Node.js 18。

故障排查:3 项自查与 2 个日志入口

服务起不来或创建模特报错时先查的 3 项

  1. 服务是否全部处于 Running 状态(标准/Linux 方案 3 个、轻量 1 个、5090 方案 2 个)?
  2. nvidia-smi是否显示显卡信息?驱动未安装是最常见的启动失败原因。
  3. 服务端与客户端是否都更新到最新版本?项目更新频繁,问题可能已在新版修复。

doc/常见问题.md 中还有两个高频问题:

  • 拉镜像报连接超时:在/etc/docker/daemon.json中配置registry-mirrors国内镜像源,文档内附可直接使用的示例。
  • 新增模特时报错:用于创建模特的视频必须有人声且是人在说话,程序要用这段声音做声音克隆,无声视频不可用。

客户端与服务端日志的查看位置

  • 客户端日志%AppData%\heygem.ai\logs下的main.log,可通过客户端"设置—打开日志"入口直接打开。
  • 服务端日志:在 Docker Desktop 中点开对应服务查看输出;镜像名分别为guiji2025/fish-speech-ziming(TTS)、guiji2025/fun-asr(ASR)、guiji2025/duix.avatar(视频合成)。
  • 日志出现Connection refused时,重点确认 10095 端口的 ASR 服务是否启动成功。

不想买 GPU 的路径:Coze 平台直接使用数字人克隆

README 中给出了本地部署与 API 服务的对照表:本地部署适合希望深度定制、可修改代码的技术型用户;API 服务无需购买 GPU 服务器、维护简单,但无法修改源码,仅能通过接口扩展。此外,项目已在 Coze 平台上线数字人克隆智能体与插件,无需本地部署即可体验:

选择本地部署时还有一个许可细节:开源版本支持全球免费商用,但用户量超过 10 万或年营收超过 1000 万美元的企业需签署商业许可协议,协议全文见仓库根目录的 Duix.Avatar model community Licensing Agreement.pdf。

下一步

以上变更点均出自 README 通知、package.json 与 deploy/ 配置,进一步可查阅:

  • 部署与升级完整步骤:README_zh.md
  • 4 套方案配置文件:deploy/
  • 拉镜像失败、创建模特报错等排错:doc/常见问题.md

【免费下载链接】Duix-Avatar🚀 Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

版权声明: 本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若内容造成侵权/违法违规/事实不符,请联系邮箱:809451989@qq.com进行投诉反馈,一经查实,立即删除!
网站建设 2026/9/11 16:12:25

Scala课程设计实战:基于滑动窗口与线性回归的交通拥堵预测

简介:一份基于Scala的交通拥堵预测课程设计源码,主要面向计算机相关专业学生、教师以及正在完成课设或大作业的开发者。项目以交通拥堵预测为业务场景,整合Scala编程、数据处理与数据库设计相关知识点,经导师指导评审获得高分&…

作者头像 李华
网站建设 2026/9/11 16:11:58

RP2040 RTC寄存器深度解析:SETUP/IRQ/INTF裸机控制实战

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

作者头像 李华
网站建设 2026/9/11 16:10:19

G-Helper CPU降压教程:-25mV降温15℃

G-Helper CPU降压教程:-25mV降温15℃ 【免费下载链接】g-helper Lightweight Armoury Crate alternative for Asus laptops with nearly the same functionality. Works with ROG Zephyrus, Flow, TUF, Strix, Scar, ProArt, Vivobook, Zenbook, Expertbook, ROG Al…

作者头像 李华
网站建设 2026/9/11 16:09:56

YOLO多版本工程化实践:SpringBoot驱动的安全锥检测系统

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

作者头像 李华
网站建设 2026/9/11 16:07:21

从输入URL到页面显示:一次完整Web请求链路的深度拆解

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

作者头像 李华