视频、图片与声音
LiveTalking
lipku/LiveTalking
一句话看懂
输入文字或声音,就能让数字人实时开口并推到网页、直播间或虚拟摄像头。
实时交互式流媒体数字人引擎:输入文字或音频即可驱动虚拟形象实时口型同步,并可通过 WebRTC、RTMP 或虚拟摄像头输出。
它能帮你完成什么
输入文字或声音,就能让数字人实时开口并推到网页、直播间或虚拟摄像头。
实时交互式流媒体数字人引擎:输入文字或音频即可驱动虚拟形象实时口型同步,并可通过 WebRTC、RTMP 或虚拟摄像头输出。
- README 列出 ER-NeRF、MuseTalk、Wav2Lip 与 Ultralight-Digital-Human 等多种数字人模型,可按不同数字人路线运行。
- 支持文本和音频驱动、实时口型同步、声音克隆、说话打断,以及不说话时播放自定义动作视频。
- 支持自定义数字人形象、全身视频拼接、多会话并发,并提供数字人形象生成页面和会话管理后台。
- 可通过 WebRTC、RTMP 和虚拟摄像头输出;README 明确列出可推流至直播平台,也提供 HTTP API 用于批量提交文案生成数字人视频。
它怎样帮上忙
从实际问题,看到对应能力。
本页根据项目 README 整理主要功能,方便先判断它是否适合你的任务。
项目档案 × 真实实验
谁真正试过这个项目?
官方档案说明它声称能做什么;社区实验记录它在真实环境里做成了什么。
还没有人公开这项实验。
如果你已经试过它,请把过程、结果和踩坑经验留给后来的人。
成为第一个实验者