📌 项目地址:OpenWhispr/openwhispr | ⭐ 7,176 颗星 | 🔧 JavaScript | 📜 未标注
项目地址:OpenWhispr/openwhispr | ⭐ 7,176 | JavaScript
这个项目解决什么问题
市面上主流语音听写工具(WisprFlow、Granola)的工作方式是:你的音频先上传到服务器,转成文字再传回来。日常闲聊无所谓,但录客户访谈、内部会议、涉密讨论时,这个流程本身就是风险。
OpenWhispr 是这两款产品的开源替代。核心卖点是本地转录:内置 Whisper 和 NVIDIA Parakeet 两个本地引擎,音频全程不离开设备。想用云端换速度也行,自带 API Key。官方声明无数据收集、无遥测,代码开源可验证。
7,176 星,这个需求量不小。
基本用法
按全局快捷键,说话,松开,文字出现在光标位置。任何输入框都生效——浏览器、编辑器、聊天软件。这个交互模式和 WisprFlow 一致,用过的人没有迁移成本。
功能上有三块:
- 语音听写:即上述全局热键听写
- 会议转录:录制并转写会议
- AI 笔记:配合转录内容生成笔记
三平台覆盖:macOS、Windows、Linux。
安装
没有命令行步骤,直接从 GitHub Releases 下载安装包:
| 平台 | 格式 |
|---|---|
| macOS (Apple Silicon) | .dmg |
| macOS (Intel) * | .dmg |
| Windows | .exe |
| Linux | .AppImage / .deb / .rpm / .tar.gz |
Intel Mac 用户注意
README 明确标了一个限制:ONNX Runtime 从 1.24 版本起不再发布 macOS x86_64 二进制,导致 Intel Mac 上两个功能不可用——实时说话人识别和声纹识别。会议录制和转录不受影响,但笔记搜索会从语义搜索退化为关键词匹配。
Apple Silicon 用户没有这个问题。用 Intel Mac 的话,先确认这几个功能你在不在意。
和 WisprFlow、Granola 比
功能清单高度重叠,差异在三点:
- 隐私可验证:本地引擎模式下音频不出设备。闭源产品怎么说都没法验证。
- 免费:没有订阅费。用云端模型时花的是自己的 API Key,用量自己控制。
- 跨平台:Linux 支持,这是两款闭源产品都没有的。
短板也说清楚:闭源商业产品在云端模型的转写准确率打磨上大概率更精细,体验的完成度也更高。如果你本来就不在乎音频上云、只求最高准确率,商业产品仍是更好的选择。
我的判断
OpenWhispr 的定位不是“更好的 WisprFlow”,而是“音频不能上云时的可用方案”。法律、医疗、内部会议这类场景,本地转录是硬需求,之前基本没有好用的开源选项。这个项目填的是这个空档。
如果你被订阅制劝退,或者对音频去向敏感,值得装一个试试。追求极致准确率的用户,再等几个版本或者继续用商业产品。