视频、图片与声音
WhisperLiveKit
QuentinFuxa/WhisperLiveKit
一句话看懂
把正在说的话实时变成字幕,同时区分说话人、翻译并输出兼容 API。
本地实时语音识别与转写工具,覆盖流式识别、说话人分离、翻译和兼容 API。
它能帮你完成什么
把正在说的话实时变成字幕,同时区分说话人、翻译并输出兼容 API。
本地实时语音识别与转写工具,覆盖流式识别、说话人分离、翻译和兼容 API。
- 项目提供本地实时语音转文字,并覆盖流式识别、说话人分离、翻译及兼容 API。
- 官方资料列出 Apple Silicon 的原生 MLX 后端,以及 Linux/GPU 的 Transformers 后端;它不是“任何电脑一点就用”的纯网页工具。
它怎样帮上忙
从实际问题,看到对应能力。
本页根据项目 README 整理主要功能,方便先判断它是否适合你的任务。
项目档案 × 真实实验
谁真正试过这个项目?
官方档案说明它声称能做什么;社区实验记录它在真实环境里做成了什么。
还没有人公开这项实验。
如果你已经试过它,请把过程、结果和踩坑经验留给后来的人。
成为第一个实验者