
一张照片实时驱动表情/姿态,4090 上毫秒级推理,配口型模型可组完整数字人,开源 MIT
LivePortrait:快手开源的实时肖像动画神器(19k★)
一句话:一张静态照片,实时驱动出表情、头部姿态、眨眼等动态效果——快手 KwaiVGI 团队开源,现已归入 Kling AI 研究(KlingAIResearch),GitHub 19k+ stars,是目前表情/姿态迁移方向最活跃的项目之一。
核心亮点
- 实时性能:在 RTX 4090 上单帧推理仅十几毫秒,可流畅实时驱动;CPU 也能跑(慢一些),还有移动端 demo
- 单图驱动:不需要训练、不需要视频素材,一张正脸照片即可
- 两种驱动模式:
- 视频驱动:用一段视频的表情/动作去驱动照片(最常用)
- 音频联动:配合 MuseTalk / EchoMimic / Wav2Lip 等口型模型,组成完整数字人说话方案
- 细节到位:精确控制眨眼、瞳孔、眉毛、嘴角,表情自然不生硬
- 多场景扩展:支持多人拼接、表情切换、动物肖像(猫猫狗狗也能动)
- 生态好:ComfyUI 插件、Web 演示、pip 一键安装,Windows / macOS / Linux 全平台
- 开源协议 MIT,商用友好
适合谁
- VTuber / 直播主:捕捉真人表情实时驱动虚拟形象
- 数字人开发者:作为"表情底座",搭配 TTS + 口型模型做完整数字人
- 短视频创作者:老照片活化、静态图变动态视频
- ComfyUI 玩家:节点式拖拽就能玩,门槛极低
局限(实话实说)
- 本身不做口型同步:音频→说话效果需要搭配 MuseTalk / EchoMimic / Wav2Lip 使用
- 对侧脸、大角度头部旋转支持一般,极端角度会变形
- 效果上限取决于输入照片质量,正脸高清图效果最佳
快速上手
git clone https://github.com/KlingAIResearch/LivePortrait
cd LivePortrait
conda create -n LivePortrait python==3.10
conda activate LivePortrait
pip install -r requirements.txt
# 下载模型权重后:
python app.py # 打开 Web 界面,上传照片开玩
入口
- GitHub:https://github.com/KlingAIResearch/LivePortrait
- 官方演示页:https://liveportrait.github.io/
- 模型权重:HuggingFace 搜索 KwaiVGI/LivePortrait(或项目 README 内链接)
总结:如果要做"真人表情实时动起来",LivePortrait 是目前开源首选;配合口型模型就是一套完整的实时数字人底座,值得收藏。
被收录:
暂无评论
