首页GitHub 项目库
剑的 AI 实验室 · 中文EN

视频、图片与声音

LiveTalking

lipku/LiveTalking

一句话看懂

输入文字或声音,就能让数字人实时开口并推到网页、直播间或虚拟摄像头。

实时交互式流媒体数字人引擎:输入文字或音频即可驱动虚拟形象实时口型同步,并可通过 WebRTC、RTMP 或虚拟摄像头输出。

它能帮你完成什么

输入文字或声音,就能让数字人实时开口并推到网页、直播间或虚拟摄像头。

实时交互式流媒体数字人引擎:输入文字或音频即可驱动虚拟形象实时口型同步,并可通过 WebRTC、RTMP 或虚拟摄像头输出。

  • README 列出 ER-NeRF、MuseTalk、Wav2Lip 与 Ultralight-Digital-Human 等多种数字人模型,可按不同数字人路线运行。
  • 支持文本和音频驱动、实时口型同步、声音克隆、说话打断,以及不说话时播放自定义动作视频。
  • 支持自定义数字人形象、全身视频拼接、多会话并发,并提供数字人形象生成页面和会话管理后台。
  • 可通过 WebRTC、RTMP 和虚拟摄像头输出;README 明确列出可推流至直播平台,也提供 HTTP API 用于批量提交文案生成数字人视频。

它怎样帮上忙

从实际问题,看到对应能力。

本页根据项目 README 整理主要功能,方便先判断它是否适合你的任务。

项目档案 × 真实实验

谁真正试过这个项目?

官方档案说明它声称能做什么;社区实验记录它在真实环境里做成了什么。

已连接 0 份实验
还没有人公开这项实验。

如果你已经试过它,请把过程、结果和踩坑经验留给后来的人。

成为第一个实验者