开源听写工具 OpenWhispr 登上 GitHub 趋势榜:本地 Whisper 转写,语音直达 AI 助手
完全开源的听写应用 OpenWhispr 支持本地 Whisper/Parakeet 引擎离线转写,音频不出设备;全局快捷键向任意应用自动粘贴文字,还能把语音直接发给 AI 助手。覆盖 macOS、Windows、Linux 三端,登上 GitHub 趋势榜。
作者:核流编辑 · 栏目:资源
语音转文字工具大多要求把录音交给云端,OpenWhispr 走了另一条路。这个完全开源的听写应用本周登上 GitHub 趋势榜,主打本地优先的语音识别:转写可以完全在设备上完成(Whisper 或 NVIDIA Parakeet 引擎),音频不出机器;项目同时声明不收集数据、无遥测,在意音频不出设备的用户可以放心用。它的价值不只在于离线转写,还在于把听写、会议记录和 AI 操作放进同一套桌面流程。 从听写到会议转写:一套语音工作流 核心能力是全局快捷键听写:在任何应用里按下快捷键说话,松开后文本自动粘贴到光标处。它还提供了一个翻译听写快捷键——用中文说话,粘贴出来的是英文。更有意思的是 AI 助手集成:可以把语音直接发给 GPT-5、Claude、Gemini 或本地模型,选中文本会被原地改写,开启自动粘贴后回答直接出现在光标位置。 会议场景同样覆盖:自动检测 Zoom、Teams 和 FaceTime 通话,提供本地说话人分离与声纹识别,还能接入日历;录制内容转成可搜索的笔记,支持语义搜索与团队空间协作。已有的音视频文件也能导入转写,支持批量上传甚至粘贴一条视频链接。 支持平台与获取方式 平台安装包 macOS(Apple Silicon / Intel).dmg Windows.exe Linux.AppImage / .deb / .rpm / .tar.gz 安装包在项目仓库的发布页即可获取,桌面端开箱即用,不需要配置云端账号。有一个必须注意的限制:Intel 架构 Mac 上实时说话人识别与声纹功能不可用(依赖的 ONNX Runtime 从 1.24 版起不再提供 macOS x86_64 构建),会议照常录制转写,笔记搜索退化为关键词匹配。本地推理支持 Metal、CUDA 与 Vulkan 加速,云引擎则可选 GPT-5、Claude、Gemini 等。 它适合的用户画像很清晰:在意音频隐私、想要免费且可自托管的语音输入方案,或者需要一个把语音、笔记和 AI 助手串起来的桌面工作流的个人与小团队。从项目仓库获取代码或安装包即可上手,团队空间功能对登录用户免费。 参考资料 OpenWhispr:OpenWhispr/openwhispr(GitHub 仓库与发布页)