首页GitHub 项目库
剑的 AI 实验室 · 中文EN

视频、图片与声音

WhisperLiveKit

QuentinFuxa/WhisperLiveKit

一句话看懂

把正在说的话实时变成字幕,同时区分说话人、翻译并输出兼容 API。

本地实时语音识别与转写工具,覆盖流式识别、说话人分离、翻译和兼容 API。

它能帮你完成什么

把正在说的话实时变成字幕,同时区分说话人、翻译并输出兼容 API。

本地实时语音识别与转写工具,覆盖流式识别、说话人分离、翻译和兼容 API。

  • 项目提供本地实时语音转文字,并覆盖流式识别、说话人分离、翻译及兼容 API。
  • 官方资料列出 Apple Silicon 的原生 MLX 后端,以及 Linux/GPU 的 Transformers 后端;它不是“任何电脑一点就用”的纯网页工具。

它怎样帮上忙

从实际问题,看到对应能力。

本页根据项目 README 整理主要功能,方便先判断它是否适合你的任务。

项目档案 × 真实实验

谁真正试过这个项目?

官方档案说明它声称能做什么;社区实验记录它在真实环境里做成了什么。

已连接 0 份实验
还没有人公开这项实验。

如果你已经试过它,请把过程、结果和踩坑经验留给后来的人。

成为第一个实验者