用 Mac 写东西的人,基本都踩过这个坑:
- 打字慢,想语音输入,系统自带听写只支持 60 秒,还得联网
- 试过付费工具,$12/月,但数据传云端,敏感内容不敢用
- 开了 5 个标签页对比 dictation app,每个都要注册、绑卡、试 7 天
- 想要本地处理保隐私,发现要么不支持中文,要么 Intel Mac 被排除
问题的本质不是语音识别技术不成熟,是"本地 + 免费 + 好用"这个组合几乎不存在。
FluidVoice 就是来解决这个问题的。
是什么
FluidVoice 是开源 macOS 语音听写 App,Swift 编写。核心思路:按一个全局快捷键,说的话实时转文字,直接打进任何输入框,全程本地处理,零数据上传。

这是 FluidVoice 的主界面,能看到今天说了多少字、节省了多少打字时间、连续用了几天。
能做什么
8 个语音模型任选
| 模型 | 特点 | 语言 | 体积 | 硬件 |
|---|---|---|---|---|
| Nemotron Speech 3.5 | 超低延迟流式 | ~40 种 | ~670MB | Apple Silicon |
| Parakeet Flash | 最低延迟英语 | 英语 | ~250MB | Apple Silicon |
| Parakeet TDT v3 | 默认多语言 | 25 种 | ~500MB | Apple Silicon |
| Cohere Transcribe | 高准确度 | 14 种 | ~1.4GB | Apple Silicon |
| Apple Speech | 零下载原生 | 系统语言 | 内置 | Apple Silicon + Intel |
| Whisper Tiny→Large | 最广兼容 | 99 种 | 75MB~2.9GB | Apple Silicon + Intel |
Parakeet TDT v3 支持 25 种语言,包括中文。Whisper 系列覆盖 99 种语言,Intel Mac 也能用。
三种工作模式
- Write Mode:在任何文本框里说话直接输入,选中文字后说"重写这段"即可改写
- Command Mode:语音控制 Mac——"打开 Safari"、"运行快捷指令"、"切换深色模式"
- File Transcription:拖入音频/视频文件,本地转录成文字
Fluid Intelligence(本地 AI 增强)
可选的本地 AI 模型(~3.5GB),运行在你的 Mac 上,零数据离开机器。功能:智能格式化、上下文感知的大小写、标点自动补全、数字和连字符处理。作者警告:"可能会让你取消其他听写 App 的订阅"。
其他特性
- Live Preview:实时转录浮层,适配 MacBook 刘海屏
- Per-App 配置:不同 App 用不同提示词——邮件里正式、代码注释里简洁、Slack 里随意
- Audio History:本地录音历史,带预算控制和 ZIP 导出
- 全局热键:默认 Right Option/Alt,任何界面一键触发
- 自适应主题:跟随系统亮/暗模式

这是 FluidVoice 官网首页,核心卖点一目了然:免费、开源、本地 AI。
实际场景
写长文不用碰键盘
打开 Notion/VS Code/Terminal,按热键开始说,文字实时出现在光标位置。说"新段落"自动换行,说"逗号""句号"自动加标点。写完按热键停止,全程手没碰键盘。
敏感内容本地处理
律师写诉状、医生写病历、程序员写内部文档——数据不能上云。FluidVoice 本地模型运行,语音和文字永远不出 Mac。连 AI 增强都是本地可选组件。
语音控制工作流
Command Mode 下说"打开邮件"、"搜索昨天的会议记录"、"运行导出脚本"——不用记快捷键,不用切换 App,嘴就是遥控器。
上手:让 AI Agent 帮你装
直接复制给 Claude Code / Cursor:
在 macOS 上安装 FluidVoice 语音听写 App,
参考 https://github.com/altic-dev/FluidVoice
要求:
1. 用 Homebrew 安装:brew install --cask fluidvoice
2. 启动后授予麦克风和辅助功能权限
3. 设置全局热键(默认 Right Option)
4. 选择语音模型(推荐 Parakeet TDT v3 支持中文,或 Apple Speech 零下载)
5. 在任意文本框测试:按热键说话,确认文字实时输入
6. 可选:启用 Fluid Intelligence 本地 AI 增强
手动 1 步:
brew install --cask fluidvoice
或从 Releases 下载 .dmg 手动安装。
首次使用 4 步:
- 打开 FluidVoice → 授予麦克风权限
- 授予辅助功能权限(用于向其他 App 输入文字)
- 选择语音模型 → 等待下载(Apple Speech 无需下载)
- 设置热键 → 在任意文本框按热键测试
从源码构建:
git clone https://github.com/altic-dev/FluidVoice.git
cd FluidVoice
open Fluid.xcodeproj
# Xcode 中 Build & Run,SPM 自动管理依赖
竞品对比
| 维度 | FluidVoice | Wispr Flow | SuperWhisper | Ottex AI |
|---|---|---|---|---|
| 价格 | 免费 | $12/月 | 免费(BYOK) 或按量付费 | |
| 本地处理 | ✅ 100% | ❌ 云端 | ✅ 100% | 可选本地/BYOK |
| 开源 | ✅ GPLv3 | ❌ | ❌ | ❌ |
| 语言 | 25~99 种 | 100+ | 100+ | 100+ |
| Intel Mac | ✅(Whisper) | ❌ | ❌ | ❌ |
| 模型选择 | ✅ 8 个 | 专有模型 | 可选模型 | 可选模型/Provider |
| Command Mode | ✅ | ❌ | ❌ | ❌ |
| File Transcription | ✅ | ❌ | ❌ | ✅ |
| AI 增强 | ✅ 本地 Fluid Intelligence | ✅ 云端 | ✅ 本地 | ✅ 云端/BYOK |
| Per-App 配置 | ✅ | ❌ | ❌ | ✅ |
| 刘海屏适配 | ✅ | ❌ | ❌ | ❌ |
Wispr Flow 胜在云端准确度和多语言,SuperWhisper 胜在设计精美和无限设备,Ottex AI 胜在专业工作流和模型切换。FluidVoice 胜在完全免费 + 完全开源 + 完全本地:零订阅费、零数据上传、8 个模型任选、Intel Mac 也能用、还有 Command Mode 语音控制。
注意点
- 仅 macOS 15+: 需要 Sequoia 或更新系统,Windows/iOS/Linux 正在开发
- Apple Silicon 体验最佳: 除 Whisper 外,其他模型需 M1/M2/M3/M4,Intel 用户选 Whisper
- Fluid Intelligence 是私有组件: 核心听写完全开源,但本地 AI 增强模型暂未开源(未来可能变化)
- 首次下载模型需等待: Parakeet TDT v3 约 500MB,Cohere 约 1.4GB,网络慢时耐心等
总结
FluidVoice 不是又一个语音输入法,是本地优先的语音工作流基础设施。想要免费、隐私、好用的 macOS 听写,不想交月费、不想数据上云、不想被硬件排除的,直接装它。
GitHub:https://github.com/altic-dev/FluidVoice
官网:https://altic.dev/fluid
夜雨聆风