Open-LLM-VTuber AI 虚拟主播:10 分钟零基础的离线部署路线
【免费下载链接】Open-LLM-VTuberTalk to any LLM with hands-free voice interaction, voice interruption, and Live2D avatar running locally across platforms项目地址: https://gitcode.com/GitHub_Trending/op/Open-LLM-VTuber
Open-LLM-VTuber 是一个完全在本地运行的语音交互 AI 虚拟主播:Live2D 形象、实时语音对话、视觉感知,全部离线跑在你的电脑上,对话数据不离开本机。跟着本文操作,你可以从零把它部署起来,打开浏览器就用语音和 AI 角色聊天。
⚙️ 部署前只需检查这三样
- Python 3.10–3.12:项目要求
>=3.10,<3.13,用uv安装依赖时它会自动处理版本,无需手动装 Python 环境。 - Ollama 服务:默认配置的大语言模型后端是 Ollama(模型
qwen2.5),启动前需要装好 Ollama 并执行ollama pull qwen2.5;你也可以改配置换用 OpenAI 兼容 API 等其他后端。 - 磁盘空间:依赖包和语音模型会下载到项目目录内,建议预留 5GB 以上。
🚀 跑通核心流程
克隆项目代码
把仓库拉到本地,前端界面是一个 Git 子模块,首次启动服务时会自动初始化,克隆时不用额外处理。
git clone https://gitcode.com/GitHub_Trending/op/Open-LLM-VTuber cd Open-LLM-VTuber确认成功:目录里能看到run_server.py和config_templates/。
用 uv 安装依赖
uv sync会按锁文件把全部依赖装进独立虚拟环境,语音识别、语音合成、Web 服务等一次装齐。
uv sync确认成功:命令跑完无报错,项目下生成.venv目录。
复制一份默认配置
配置文件决定用哪个 LLM、ASR、TTS。中文用户建议直接复制中文预设版,里面预置了中文语音音色;英文版用config_templates/conf.default.yaml。即使不复制,首次启动时服务也会自动从模板生成一份conf.yaml。
cp config_templates/conf.ZH.default.yaml conf.yaml确认成功:项目根目录出现conf.yaml。
启动服务
服务是 FastAPI + WebSocket 结构,启动时会加载配置、初始化语音模型,然后监听端口。
uv run run_server.py确认成功:终端出现Starting server on localhost:12393,浏览器访问http://localhost:12393就能看到 Live2D 形象界面。
🎧 上手后的功能体验
实时语音对话:打开页面后点击麦克风按钮说话,角色边听边想边回答,支持你随时插话打断,AI 不会听到自己的声音。
视觉感知:开启屏幕共享或摄像头,AI 就能"看到"你的屏幕内容,你可以问它屏幕上正在显示什么。
桌宠模式:桌面客户端支持透明背景、全局置顶和鼠标穿透,可以把 AI 伴侣拖到屏幕任意位置,让它常驻陪伴。
🎨 个性化配置改哪里
全局配置在项目根目录的conf.yaml,改asr_config、tts_config、llm_configs即可切换识别、合成和对话引擎,改完重启服务生效。
多角色管理放在characters/目录:每个 yaml 文件只写你要改的项(人设、音色、模型),其余自动继承conf.yaml,前端界面里可以直接运行时切换。想加新的 Live2D 模型,把模型文件夹放进live2d-models/,再在model_dict.json里登记名称即可。
⚠️ 容易踩的坑
- 浏览器打开是空白或提示
Not Found→ 前端子模块没初始化成功,重启uv run run_server.py会自动执行git submodule update --init --recursive;仍失败就手动跑一次这条命令。 - 角色只动嘴不出声或回答很慢 → 多半是 Ollama 没跑起来或没拉取
qwen2.5模型,先单独确认 Ollama 能正常对话。 - 完全离线环境下语音合成失败 → 默认 TTS 是
edge_tts,需要联网;换成tts_config里的sherpa_onnx_tts等本地方案。
收束
从克隆代码到浏览器里和 AI 角色说话,整条路径就是:克隆 →uv sync→ 复制conf.yaml→uv run run_server.py。下一步建议先在characters/里照着现有预设复制一份角色文件,改一句人设体验定制效果。遇到问题,优先看仓库 README 里列出的常见问题文档,或进项目社区群提问,通常都有人踩过同样的坑。
【免费下载链接】Open-LLM-VTuberTalk to any LLM with hands-free voice interaction, voice interruption, and Live2D avatar running locally across platforms项目地址: https://gitcode.com/GitHub_Trending/op/Open-LLM-VTuber
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考