LiveTalking - 实时流式数字人引擎,文本/语音驱动虚拟形象对话

LiveTalking - 实时流式数字人引擎,文本/语音驱动虚拟形象对话


实时交互流式数字人引擎,9.3K Stars。支持 Wav2Lip/MuseTalk/Ernerf 多模型,WebRTC/RTMP/虚拟摄像头输出,已广泛商用

LiveTalking 是实时交互流式数字人引擎,通过文本或语音驱动虚拟形象说话,结合 LLM 实现智能对话,已在业内获得广泛商用。

GitHub 9.3K+ Stars,1.4K+ Fork,Apache 2.0 开源协议。

核心功能

  • 多种数字人模型:Wav2Lip、MuseTalk、Ernerf、Ultralight-Digital-Human
  • 声音克隆:支持自定义声音
  • 语音打断:数字人说话过程中可被打断
  • 全身视频拼接、自定义数字人形象
  • 输出方式:WebRTC 低延迟推流、RTMP 直播推流、虚拟摄像头
  • 动作编排:不说话时播放自定义视频
  • 多并发支持,提供完整 HTTP API 接口
  • 插件系统:可自行扩展 TTS、Avatar、Output 模块

使用场景

  • 虚拟主播/直播带货(24小时无人直播)
  • AI 数字人客服(接入企业知识库)
  • 在线教育/培训
  • 大屏讲解、短视频批量制作

系统架构:用户输入文字/音频 → LLM 生成回复(可选)→ TTS 合成语音 → 数字人实时口型同步 → 音视频推流输出

实时性能:Wav2Lip 在 RTX 3060 上可达 60 FPS,RTX 3080Ti 达 120 FPS。

支持 Ubuntu / Windows / macOS,提供 Docker 镜像和 Windows 整合包。

GitHub: https://github.com/lipku/LiveTalking 文档: https://doc.livetalking.ai

9900举报0子龙•27天前
点击获取 ^_^
被收录:

暂无评论