HeyGem.ai 数字人本地部署完整指南:从安装到产出第一条视频
【免费下载链接】Duix-Avatar🚀 Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar
HeyGem.ai 是一款支持完全离线的 AI 视频生成工具,可在本地部署。你在自己电脑上完成数字形象创建、文本转视频与音频驱动,全程不依赖外网。本文面向有 NVIDIA 显卡、想在本地搭建数字人工作流的内容创作者与技术用户。
能做出什么
- 数字形象创建:上传约 10 秒的真人视频,输出一个可复用的数字分身,同时克隆你的声音。
- 文本转视频:输入一段文字稿,输出带口型的口播视频,文字先合成为语音再驱动形象开口。
- 多模态输入:输入可以是纯文本、上传的音频或实时录音,输出对应的口播或配音视频。
本地装起来
先确认环境是否满足这三项:
- Node.js 18(客户端运行环境)
- 可选 GPU:NVIDIA 显卡且已装驱动,推荐 RTX 4070、内存 32G 及以上
- 磁盘:系统盘预留 100G 存放服务镜像,数据盘预留 30G 存模型与作品
获取代码,把项目拉到本地:
git clone https://gitcode.com/GitHub_Trending/he/Duix-Avatar进入项目目录后安装依赖,建议在网络稳定时执行:
npm install启动验证,确认客户端与本地服务都能拉起:
npm run dev看到界面正常渲染、服务无报错,说明基础环境已就绪。
产出第一条视频
- 创建形象:进入客户端点击「Create Avatar」,上传一段清晰、光线均匀的视频,等系统完成外貌与声音克隆。
- 文本驱动:在「Create Video」里粘贴一段文字稿,选刚建好的形象并点击生成,得到口型同步的口播视频。
- 音频驱动:改传一段录音或音频文件,跳过文本合成,直接用你的声音驱动形象开口。
跑得更稳更快
Docker 容器化:服务端以三个容器跑在本地,进入deploy目录启动:
docker-compose up -d首次拉取镜像约 70G,建议连 WiFi 并预留充足时间。
GPU 加速:确认显卡驱动装好(nvidia-smi能打印显卡信息),容器即会调用 CUDA,明显提升合成速度。
存储与内存:在 Docker Desktop 的 Resources → Advanced 里调整磁盘镜像位置与内存分配,避免系统盘写满。
依赖安装失败:多为镜像拉取超时,在 Docker Engine 的 daemon 配置里加 registry-mirrors 镜像源加速:
权限不足:客户端起不来时,先查看服务端日志定位报错,常见为文件缺失或路径无读写权限,修正目录权限或换管理员身份运行即可。
更多排查思路见 常见问题。
接着可以玩什么
跑通第一条视频后,你可以继续训练自己的语音模型、开启中/英/日/韩等八种语言脚本,或批量生成多条口播内容。
到这里,你已经完成了 HeyGem.ai 数字人工具从本地安装、依赖搭建到产出视频与调优的完整闭环;下一步可参考仓库的 开放 API 文档,把模特训练与视频合成接进自己的业务流程。
【免费下载链接】Duix-Avatar🚀 Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考