标准
额度 ×1- 实时字幕,松手秒出
- 中英混说最稳(亲测基准)
- 额度消耗最低
- 纯英文长句的公开流式基准中游
说话的时候,想法是自己冒出来的——打字才需要第二道工序。 对着任何输入框说,口语进,整理好的文字出。微信、邮件、代码注释,光标在哪,落在哪。
这段演示是代码画的,不是视频——App 里的胶囊长什么样,这里就是什么样。
一天几十次输入,每次省下的那一两分钟,就是这个页面想说的全部。
说什么,写什么。口语里的「嗯、那个、就是说」会被 AI 清理掉,落下的是通顺的书面文字。
右 ⌘说中文,落下的是英文;说英文,落下的是中文。方向自动判断,发消息给外国同事是说一句话的事。
右 ⌥把问题说出来,落下的不是你的话,是答案。查个词、算个数,不用切去浏览器。
fn选中一段文字,说怎么改 —— 落回去的是改完的样子。说完还能用嘴改,才算闭环。
右 ⌃你不是在一个字一个字地写代码,你是在跟它讲清楚要什么 —— 「把这个 function 改成 async,然后加个 retry」。 这句话说出来三秒,敲出来要三十秒。 Murmur 没有插件,没有集成,也不需要你配什么 —— 它就是个系统级听写,落在任何光标处,包括终端里那个正等你输入的提示符。
市面上的识别模型,我们在产品团队内部做了一整套测评,选出三个最主要的提供给你。 没有哪一家在所有场景都最好 —— 你怎么说话才重要,所以按场景分成三档: 优缺点写在明面上,一层菜单直接切,换挡不用懂任何术语。
现在就能用的是「标准」档,另外两档正在内测里逐步放开。 「额度 ×2」的意思是:同一份额度,这一档消耗按两倍计 —— 比如长录音录 1 分钟, 从时长池里扣 2 分钟,消耗写在档位旁边,没有隐藏折算。断网或额度用完时 自动落回本机识别:慢一点、混说弱一点,但不变砖,你的话也不会丢。
账号、登录、订阅——这是我们服务器仅有的工作。你的录音、转写、历史、词典, 一个字都不上传,全部只存在你的 Mac 上。云端识别时,音频直连你自己选的那家模型商, 不经过我们;选本机识别,则一个字节都不出这台电脑。
你说话 —— 音频只从你的 Mac 出发
~/Library/Application Support/Murmur/
录音和你说过的每一个字,都在这个文件夹里,不信随时自己打开看。删掉,就是真的删掉了。
每次听写都留着录音和一条历史。云端挂了、识别错了?回历史里换个模型重跑——没有哪条路径会让你说过的话凭空消失。
没翻译成,会告诉你没翻译成;麦克风没收到声,当场就说。不会把一段兜底出来的乱码,悄悄塞进你正在打字的窗口。
选本机识别,音频一个字节不出这台电脑;选云端,用了哪家、发了什么,设置里白纸黑字——不藏在条款第八页。
「松手到出字」的延迟是实测中位数,不是文案写的。识别档位的优缺点也写在明面上 —— 不合适就换一档,你的耳朵说了算。
长录音是另一条管线:实时字幕浮窗盖在任何全屏窗口上面 —— 网课照常放,字幕自己跟; 想看译文就开双栏。字幕只是可牺牲的预览,它断了课不断:完整版录完照常落历史, 还分得出谁在说话。
这段演示是代码画的,不是视频。长录音免费档每月 30 分钟。
你的录音、转写、历史、词典全存在你的 Mac 本地,我们的服务器只处理账号和订阅。云端识别时,音频直连那一家识别服务,不经我们的服务器——用免费额度(我们代付)时也一样。唯一的例外要说清:用免费额度时,整理环节的文字会先经我们的服务器再转给模型厂商。选本机识别,一个字节都不出电脑。词典里的专有名词会随请求发给识别服务(为了听对它们)——这些都写在设置里,不是藏在条款里。
断网或额度用完,都自动落回本机识别——慢一点、混说弱一点,但你的话不会丢。恢复之后,历史里的任何一条都可以换云端档位重跑。
中文、英文,以及它们夹在一起说——最后这种恰恰是它做得最认真的。中文带方言口音(粤/川渝/吴)也有专门的档位(内测中,逐步开放)。
不需要。云端额度现阶段是内测邀请制:拿到名额、登录,免费额度就在 —— 那是我们替你付的云端账单,用完自动切回本机识别,不会停下来问你要钱。
只支持 macOS 26 及以上、Apple Silicon(M 系列)的 Mac · 免费开始 · 云端额度内测邀请制
Intel Mac,或系统还在 macOS 25 及以下?现在装不上 —— 留个邮箱到 foraiandfocus+murmur@gmail.com,支持了第一时间告诉你。
下载免费,本机识别不用登录就能用。要云端额度的话,现在是内测邀请制 —— 写封信到 foraiandfocus+murmur@gmail.com 要一个,说一句你想用它做什么就行。
解压后把 Murmur 拖进「应用程序」。首次使用会请求麦克风与辅助功能权限 —— 前者听你说话,后者把字落进光标处。