Open-LLM-VTuber 完整指南:3 步搭建实时语音对话的 AI 虚拟主播 📅 发布时间:2026/9/12 6:06:56 👁 浏览次数: Open-LLM-VTuber 完整指南3 步搭建实时语音对话的 AI 虚拟主播【免费下载链接】Open-LLM-VTuberTalk to any LLM with hands-free voice interaction, voice interruption, and Live2D avatar running locally across platforms项目地址: https://gitcode.com/GitHub_Trending/op/Open-LLM-VTuber深夜写代码卡在一个问题上身边没人能问。你不想打字直接开口说出来——屏幕上的 Live2D 角色听完思考了一下用声音回答了你。这就是 Open-LLM-VTuber一个完全离线运行、支持实时语音对话的 AI 虚拟主播。读完这篇文章你将学会 3 步部署它并知道如何换角色、换场景、把角色变成桌宠。项目速览Open-LLM-VTuber 是一个把 Live2D 虚拟形象和大语言模型结合的开源项目所有功能都能在你的电脑上离线运行。实时语音对话开口就能聊语音识别、思考、语音合成全链路打通随时可以插话打断离线部署本地模型即可工作对话数据不出你的设备视觉感知接上摄像头或共享屏幕角色能看到你的画面跨平台Windows、macOS、Linux 都支持可按配置选择 CPU 或云端 API桌宠模式透明背景、全局置顶把角色拖到屏幕任意位置环境要求Python 3.10 到 3.12、uv 包管理工具以及几 GB 磁盘空间存放模型。3 步跑起来 把项目拉下来克隆仓库并进入项目目录git clone https://gitcode.com/GitHub_Trending/op/Open-LLM-VTuber cd Open-LLM-VTuber⚡ 安装依赖项目用 uv 管理依赖没装过 uv 的话先安装它然后执行uv sync▶️ 启动服务uv run run_server.py首次启动会把默认配置模板生成conf.yaml。打开浏览器访问http://localhost:12393看到 Live2D 角色和绿色的 Connected 状态即表示部署成功。功能场景拆解️ 语音对话全程不碰键盘最基础的用法就是空手聊天。你说一句话角色听完后用声音回应你说停它也能立刻停下。实时语音识别说话即转文字语音打断不戴耳机也不会听见自己的声音触摸反馈点击或拖拽角色它会做出反应情绪映射表情聊天时角色的表情会随内容变化桌面客户端左侧是聊天历史与摄像头面板底部麦克风按钮开启语音对话 角色主动说话还能看到你的屏幕不一定要你先开口。角色可以主动搭话也可以接摄像头、共享屏幕看懂你在做什么。AI 主动说话空闲时角色会自己发起话题摄像头与屏幕感知分析你共享的画面内容聊天记录持久化随时切回之前的对话内心独白角色的想法显示出来但不被读出来浏览器端访问 localhost:12393角色主动发起中文对话背景可自定义 桌宠模式让角色待在代码编辑器旁边桌面客户端支持窗口模式和桌宠模式切换。切换后背景变透明、窗口置顶你可以把它拖到屏幕角落写代码时随时抬眼就能看到它。透明背景、全局置顶、鼠标穿透拖拽到屏幕任意位置内置 mao_pro、shizuku 两个模型可直接体验桌宠模式角色悬浮在编辑器窗口旁不打断你的工作进阶玩法 定制你自己的角色在 characters/ 目录新建一个 yaml 文件。只需要填你想改的部分persona_prompt是角色性格的核心想换外观把 Live2D 模型放进live2d-models/并在 model_dict.json中登记名称换场景从 backgrounds/ 目录挑一张图设为背景配置与性能调优所有模块都能在conf.yaml里切换默认模板见 config_templates/conf.default.yaml。LLM 支持 Ollama 本地模型和各类云端 API。配置低就先选轻量的本地模型想让角色用日语发声、但你用中文聊天可开启 TTS 翻译功能觉得首次回应慢开启faster_first_response第一句说完就开口不用等整段生成避坑指南Q安装依赖报错或卡住A先确认 Python 在 3.10–3.12 之间并且已安装 uv 再执行uv sync。网络问题请查阅官方文档的镜像方案。Q浏览器打开后显示{detail:Not Found}A前端是 git 子模块克隆时可能没拉全。按启动日志的提示重新执行git submodule update --init --recursive即可。Q麦克风按钮点了没反应A麦克风只在 localhost 或 https 环境下可用。要在手机等其他设备访问需要配反向代理加 https。Q新建的角色不显示或切换不生效A检查 yaml 里的conf_uid是否唯一live2d_model_name是否与 model_dict.json 里的名称完全一致。Q本地模型跑起来响应太慢A把 LLM 换成更小的模型或直接改用云端 API。具体模型选择请查阅官方文档确认。写在最后到这里一个能听会说的 AI 虚拟主播已经完整跑起来了。打开终端把开头的克隆命令执行一遍几分钟后角色就会用声音跟你打招呼。【免费下载链接】Open-LLM-VTuberTalk to any LLM with hands-free voice interaction, voice interruption, and Live2D avatar running locally across platforms项目地址: https://gitcode.com/GitHub_Trending/op/Open-LLM-VTuber创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考