news 2026/9/30 1:46:37

Open-LLM-VTuber AI 虚拟主播:10 分钟零基础的离线部署路线

作者头像

张小明

前端开发工程师

1.2k 24
文章封面图
Open-LLM-VTuber AI 虚拟主播:10 分钟零基础的离线部署路线

Open-LLM-VTuber AI 虚拟主播:10 分钟零基础的离线部署路线

【免费下载链接】Open-LLM-VTuberTalk to any LLM with hands-free voice interaction, voice interruption, and Live2D avatar running locally across platforms项目地址: https://gitcode.com/GitHub_Trending/op/Open-LLM-VTuber

Open-LLM-VTuber 是一个完全在本地运行的语音交互 AI 虚拟主播:Live2D 形象、实时语音对话、视觉感知,全部离线跑在你的电脑上,对话数据不离开本机。跟着本文操作,你可以从零把它部署起来,打开浏览器就用语音和 AI 角色聊天。

⚙️ 部署前只需检查这三样

  • Python 3.10–3.12:项目要求>=3.10,<3.13,用uv安装依赖时它会自动处理版本,无需手动装 Python 环境。
  • Ollama 服务:默认配置的大语言模型后端是 Ollama(模型qwen2.5),启动前需要装好 Ollama 并执行ollama pull qwen2.5;你也可以改配置换用 OpenAI 兼容 API 等其他后端。
  • 磁盘空间:依赖包和语音模型会下载到项目目录内,建议预留 5GB 以上。

🚀 跑通核心流程

克隆项目代码

把仓库拉到本地,前端界面是一个 Git 子模块,首次启动服务时会自动初始化,克隆时不用额外处理。

git clone https://gitcode.com/GitHub_Trending/op/Open-LLM-VTuber cd Open-LLM-VTuber

确认成功:目录里能看到run_server.py和config_templates/。

用 uv 安装依赖

uv sync会按锁文件把全部依赖装进独立虚拟环境,语音识别、语音合成、Web 服务等一次装齐。

uv sync

确认成功:命令跑完无报错,项目下生成.venv目录。

复制一份默认配置

配置文件决定用哪个 LLM、ASR、TTS。中文用户建议直接复制中文预设版,里面预置了中文语音音色;英文版用config_templates/conf.default.yaml。即使不复制,首次启动时服务也会自动从模板生成一份conf.yaml。

cp config_templates/conf.ZH.default.yaml conf.yaml

确认成功:项目根目录出现conf.yaml。

启动服务

服务是 FastAPI + WebSocket 结构,启动时会加载配置、初始化语音模型,然后监听端口。

uv run run_server.py

确认成功:终端出现Starting server on localhost:12393,浏览器访问http://localhost:12393就能看到 Live2D 形象界面。

🎧 上手后的功能体验

实时语音对话:打开页面后点击麦克风按钮说话,角色边听边想边回答,支持你随时插话打断,AI 不会听到自己的声音。

视觉感知:开启屏幕共享或摄像头,AI 就能"看到"你的屏幕内容,你可以问它屏幕上正在显示什么。

桌宠模式:桌面客户端支持透明背景、全局置顶和鼠标穿透,可以把 AI 伴侣拖到屏幕任意位置,让它常驻陪伴。

🎨 个性化配置改哪里

全局配置在项目根目录的conf.yaml,改asr_config、tts_config、llm_configs即可切换识别、合成和对话引擎,改完重启服务生效。

多角色管理放在characters/目录:每个 yaml 文件只写你要改的项(人设、音色、模型),其余自动继承conf.yaml,前端界面里可以直接运行时切换。想加新的 Live2D 模型,把模型文件夹放进live2d-models/,再在model_dict.json里登记名称即可。

⚠️ 容易踩的坑

  • 浏览器打开是空白或提示Not Found→ 前端子模块没初始化成功,重启uv run run_server.py会自动执行git submodule update --init --recursive;仍失败就手动跑一次这条命令。
  • 角色只动嘴不出声或回答很慢 → 多半是 Ollama 没跑起来或没拉取qwen2.5模型,先单独确认 Ollama 能正常对话。
  • 完全离线环境下语音合成失败 → 默认 TTS 是edge_tts,需要联网;换成tts_config里的sherpa_onnx_tts等本地方案。

收束

从克隆代码到浏览器里和 AI 角色说话,整条路径就是:克隆 →uv sync→ 复制conf.yaml→uv run run_server.py。下一步建议先在characters/里照着现有预设复制一份角色文件,改一句人设体验定制效果。遇到问题,优先看仓库 README 里列出的常见问题文档,或进项目社区群提问,通常都有人踩过同样的坑。

【免费下载链接】Open-LLM-VTuberTalk to any LLM with hands-free voice interaction, voice interruption, and Live2D avatar running locally across platforms项目地址: https://gitcode.com/GitHub_Trending/op/Open-LLM-VTuber

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

版权声明: 本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若内容造成侵权/违法违规/事实不符,请联系邮箱:809451989@qq.com进行投诉反馈,一经查实,立即删除!
网站建设 2026/9/30 1:46:00

linux-command 命令详解:atrm 删除 at 定时任务队列中的指定任务

文档教程 【免费下载链接】linux-command Linux命令大全搜索工具&#xff0c;内容包含Linux命令手册、详解、学习、搜集。https://git.io/linux 项目地址&#xff1a; https://gitcode.com/GitHub_Trending/linux/linux-command 点击查看 免费下载 本文是 Linux 命令大全仓库&…

作者头像 李华
网站建设 2026/9/30 1:44:51

DLSS Swapper:一键替换游戏超分DLL到新版,3秒回滚

DLSS Swapper&#xff1a;一键替换游戏超分DLL到新版&#xff0c;3秒回滚 【免费下载链接】dlss-swapper 项目地址: https://gitcode.com/GitHub_Trending/dl/dlss-swapper 盯着那个写死的 2.1 版本号看了三秒 你盯着游戏设置里的 DLSS 版本 2.1&#xff0c;搜「DLSS …

作者头像 李华
网站建设 2026/9/30 1:44:45

高并发服务的防御性编程与容量规划

高并发服务的防御性编程与容量规划在构建面向生产的高并发服务时&#xff0c;系统最大的敌人往往不是来自外部的正常流量&#xff0c;而是系统自身对异常情况的脆弱性&#xff1a; 下游某个慢 API 响应变慢&#xff0c;导致上游线程池全部占满并产生雪崩&#xff1b;突发的流量…

作者头像 李华
网站建设 2026/9/30 1:44:05

Redis 在 AI 时代的定位演进:从缓存利器到全栈内存数据平台

Redis 在 AI 时代的定位演进&#xff1a;从缓存利器到全栈内存数据平台在大语言模型&#xff08;LLM&#xff09;、多模态生成式 AI 与复杂智能体&#xff08;Agent&#xff09;系统席卷全球软件架构的浪潮下&#xff0c;Redis 这一经典的开源分布式内存组件&#xff0c;正在经…

作者头像 李华
网站建设 2026/9/30 1:43:42

CI/CD 智能化九月全景总结:把智能诊断与自动化自愈做进每日工作流

CI/CD 智能化九月全景总结&#xff1a;把智能诊断与自动化自愈做进每日工作流在现代软件交付流水线&#xff08;CI/CD&#xff09;的日常运转中&#xff0c;“流水线变红”曾经是每一个开发者最不想面对的心智折磨&#xff1a; 开发者为了查一个简单的 Lint 警告或偶发的网络超…

作者头像 李华
网站建设 2026/9/30 1:41:17

【动手学深度学习】深入浅出深度学习之PyTorch基础

&#x1f31e;一、实验目的 正确理解深度学习所需的数学知识&#xff1b;学习一些关于数据的实用技能&#xff0c;包括存储、操作和预处理数据&#xff1b;能够完成各种数据操作&#xff0c;存储和操作数据&#xff1b;PyTorch基础&#xff0c;完成《动⼿学深度学习》预备知识2…

作者头像 李华