
实时交互流式数字人引擎,9.3K Stars。支持 Wav2Lip/MuseTalk/Ernerf 多模型,WebRTC/RTMP/虚拟摄像头输出,已广泛商用
LiveTalking 是实时交互流式数字人引擎,通过文本或语音驱动虚拟形象说话,结合 LLM 实现智能对话,已在业内获得广泛商用。
GitHub 9.3K+ Stars,1.4K+ Fork,Apache 2.0 开源协议。
核心功能
- 多种数字人模型:Wav2Lip、MuseTalk、Ernerf、Ultralight-Digital-Human
- 声音克隆:支持自定义声音
- 语音打断:数字人说话过程中可被打断
- 全身视频拼接、自定义数字人形象
- 输出方式:WebRTC 低延迟推流、RTMP 直播推流、虚拟摄像头
- 动作编排:不说话时播放自定义视频
- 多并发支持,提供完整 HTTP API 接口
- 插件系统:可自行扩展 TTS、Avatar、Output 模块
使用场景
- 虚拟主播/直播带货(24小时无人直播)
- AI 数字人客服(接入企业知识库)
- 在线教育/培训
- 大屏讲解、短视频批量制作
系统架构:用户输入文字/音频 → LLM 生成回复(可选)→ TTS 合成语音 → 数字人实时口型同步 → 音视频推流输出
实时性能:Wav2Lip 在 RTX 3060 上可达 60 FPS,RTX 3080Ti 达 120 FPS。
支持 Ubuntu / Windows / macOS,提供 Docker 镜像和 Windows 整合包。
GitHub: https://github.com/lipku/LiveTalking 文档: https://doc.livetalking.ai
暂无评论
