在 Mac 上口述邮件或笔记,方便归方便,但你未必愿意把日常对话上传到服务器。FluidVoice 提供了另一条路线:语音识别——把人声转成可编辑文字——可以在设备端完成,后续的标点整理、大小写修正和格式处理也能留在本机,不需要 API key,数据不离开 Mac。
它支持 Nemotron Speech 3.5、Parakeet、Apple Speech 和 Whisper 等多种语音模型,并用实时浮层显示转写结果;文字还能通过系统辅助功能直接填进不同应用。除普通听写外,FluidVoice 也提供语音控制 Mac 的 Command Mode,以及在任意文本框中口述或改写内容的 Write Mode。项目目前面向 macOS,可通过 Homebrew 安装,核心应用以 GPLv3 开源。
边界也值得留意:本地文本增强所用的 Fluid Intelligence 运行时目前并不开源,由开发者单独维护;应用也支持可选的云端 AI 服务。因此,“完全本地”是用户可以选择的工作方式,而不是所有配置天然如此。项目页面未提供独立测试数据,本机速度和效果仍会受所选模型与硬件影响。