
开源语音交互 AI 虚拟伴侣,13.5K Stars。支持实时语音对话、视觉感知、Live2D 形象,桌面宠物模式可完全离线运行
Open-LLM-VTuber 是一个开源的语音交互 AI 虚拟伴侣,支持实时语音对话、视觉感知和 Live2D 虚拟形象,所有功能可完全离线运行。
GitHub 13.5K+ Stars,1.6K+ Fork,MIT 开源协议。
核心功能
- 实时语音对话:支持语音打断(不戴耳机也能用,AI 不会听到自己的声音)
- 视觉感知:支持摄像头、屏幕录制和截图,AI 能看到你和你屏幕上的内容
- Live2D 虚拟形象:可自定义角色外观、表情和人格
- 桌面宠物模式:透明背景、置顶、鼠标穿透,AI 陪伴在屏幕任意位置
- AI 主动说话、内心独白展示、触摸反馈
支持的后端模型
- LLM:Ollama、OpenAI 兼容 API、Gemini、Claude、DeepSeek、智谱等
- ASR 语音识别:sherpa-onnx、FunASR、Faster-Whisper、Whisper.cpp、Azure ASR 等
- TTS 语音合成:sherpa-onnx、GPTSoVITS、CosyVoice、Edge TTS、Fish Audio、Bark、Mel tTTS 等
跨平台支持 Windows / macOS / Linux,提供 Web 版和桌面客户端两种使用模式。
GitHub: https://github.com/t41372/Open-LLM-VTuber 文档: https://open-llm-vtuber.github.io/docs/quick-start
暂无评论
