3 条命令搭好本地 AI 语音虚拟主播:Open-LLM-VTuber 从安装到开口聊天全记录 📅 发布时间:2026/9/12 1:57:43 👁 浏览次数: 3 条命令搭好本地 AI 语音虚拟主播:Open-LLM-VTuber 从安装到开口聊天全记录【免费下载链接】Open-LLM-VTuberTalk to any LLM with hands-free voice interaction, voice interruption, and Live2D avatar running locally across platforms项目地址: https://gitcode.com/GitHub_Trending/op/Open-LLM-VTuber和 AI 聊天还在逐字打字?想要一个能听你说话、会看你的屏幕、有表情会回应的虚拟伙伴,又不想把对话内容交给云端服务?Open-LLM-VTuber 正是一个这样的开源项目:它把 Live2D 动态形象和 LLM(大语言模型,负责想和说的 AI 引擎)组合在一起,让你的 AI 语音伴侣完全离线运行在自己的电脑上,支持 Windows、macOS 和 Linux。3 条命令从零启动本地 AI 语音虚拟主播服务整个部署过程只需要 3 条命令,不需要手动安装几十个依赖包:git clone https://gitcode.com/GitHub_Trending/op/Open-LLM-VTuber cd Open-LLM-VTuber uv sync uv run run_server.py克隆仓库:git clone下载项目源码。安装依赖:项目用uv(一个快速的 Python 包管理器)管理环境,uv sync会根据pyproject.toml一键装好全部依赖。启动服务:uv run run_server.py拉起本地服务。服务启动后,浏览器打开http://localhost:12393(默认端口),看到会动的 Live2D 角色,就说明成功了。提前绕开这几个坑:Python 版本要求 3.10~3.12(项目声明3.10,3.13),版本不对时uv sync会直接报错,先升级 Python 再重试。首次启动会下载模型文件到项目的models/目录,所以第一次会比之后慢很多,耐心等待即可。麦克风只在 localhost 下生效。浏览器出于安全考虑,在非本机地址(比如用手机访问电脑的 IP)不开放麦克风,想远程访问需要自己配 HTTPS 反向代理,新手建议先在本机玩。如果页面出现detail:Not Found,通常是frontend前端子模块没初始化——启动脚本会自动尝试拉取,失败时检查一下网络或手动执行git submodule update --init即可,不要手动改动frontend/目录。实时语音对话、屏幕感知与桌宠模式:体验本地 Live2D AI 伴侣跑通之后,这个屏幕里的伙伴能干的事,比大多数网页聊天框多不少。直接开口说,打断它也正常打开麦克风,对着电脑说话,它的语音识别(ASR,把你说的话转成文字)会实时生效;你说到一半改口,它能语音打断,不会硬等你说完。回复时,文本会被切成短句,由 TTS(文本转语音,让文字变成声音)逐句播出来,而不是等你看完一整段。整个过程不需要打字。左侧是配置面板,右侧是实时响应的 Live2D 角色,表情和口型会跟着对话内容变化。它还能看见你的屏幕开启屏幕共享或摄像头后,它进入视觉感知模式:你可以指着屏幕问这段代码哪里有 bug,或者拍张照片让它描述内容。对看屏幕学东西这个场景,它比纯文本对话更直观。从网页窗格,到趴在桌面的小宠物除了网页版,项目还支持桌面客户端,其中最有意思的是桌宠模式:背景透明、窗口全局置顶、鼠标可穿透,角色可以拖到屏幕任意角落,不挡你干活,你写代码它在旁边看着。离线运行,对话内容不出你的电脑这是和云端 AI 最大的差别:LLM、ASR、TTS 都可以选择本地模型(项目内置了 Ollama、sherpa-onnx、Faster-Whisper、CosyVoice 等一大堆可替换方案),关掉网络也能聊,聊天记录持久化存储在本机,随时翻回之前的对话。自定义 Live2D 角色人设、语音合成与背景场景玩熟了基础功能,接下来就是你的 AI 你做主。换人设,不用写代码。项目自带的characters/目录里就有现成角色配置,比如米粒和翻译腔——每个角色就是一个 YAML 文件,改persona_prompt字段就能重写性格,保存后在网页里切换即可。换形象。Live2D 模型放在live2d-models/下,内置了猫娘 mao_pro 和 shizuku 两套官方示例模型(见 live2d-models/),你也可以导入自己的模型;表情由后端情绪映射驱动,聊天时会自动切换。换场景。backgrounds/里备了十几个现成背景——夜景、教室、山谷——改一下配置里的背景路径,角色的舞台就变了:换声音。TTS 模块支持 GPTSoVITS、Bark、Edge TTS、CosyVoice 等十几种方案,想换音色甚至做音色克隆,都只需要在配置里切换模块,不用动代码。所有模块配置集中在conf.yaml(模板见 config_templates/),LLM、ASR、TTS 各自独立,像换电池一样替换。总结:你得到了什么,下一步做什么花 5 分钟,你现在有了一个:3 条命令启动、跨平台的本地 AI 语音伴侣;支持实时语音对话 打断 屏幕视觉感知;带 Live2D 形象、可拖拽的桌宠模式;完全离线运行,隐私留在自己设备。建议的下一步:先按默认配置把语音聊起来,然后打开characters/写一个属于你自己的角色人设,最后把背景换成backgrounds/里你最喜欢的那张——一个独一无二的本地 AI 虚拟主播,就这样完成了。【免费下载链接】Open-LLM-VTuberTalk to any LLM with hands-free voice interaction, voice interruption, and Live2D avatar running locally across platforms项目地址: https://gitcode.com/GitHub_Trending/op/Open-LLM-VTuber创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考