一个不上传你音频的转写应用
云端转写又快又准,是因为它跑在别人的硬件上 —— 也就是说,你的会议、你的采访、你的讲座,在变成文字之前先被复制到了一台服务器上。Murmur 把整件事留在你的手机里。
两种设计,一个你能感觉到的差别
从外面看两者一模一样:按下录音,文字稿出现。不同的是这中间发生了什么。云端服务把录音压缩、经网络送走、排进一台你看不见的机器的队列,再把文字送回来。本机应用则把语音识别模型装进手机内存,在那里做同样的事。其余的一切 —— 隐私叙事、离线能力、账号、「服务还在不在」这个问题、法务想读的那份数据处理协议 —— 都是这一个选择的结果。
- 没有上传这一步,也就没有上传的风险
- 没有可被截获的传输,没有可能配置错误的存储桶,也没有只能选择相信的保留期限。你的录音不会被发送到我们的服务器,因为这条路径上根本没有服务器。
- 没有要创建的账号,也没有要注销的账号
- 云端转写从注册开始,因为服务器必须知道它保管的是谁的文件。Murmur 没有可登录的地方:没有资料、没有密码,也没有需要追着要的删除数据请求。
- 网络不再重要
- 云端文字稿需要带宽,会议室信号一差,它就变成一条转个不停的进度条。本机转写按你手机的速度推进 —— 在地下室,或在一万米高空。
- 服务挂了它照样能用
- 故障、改价、停运,是托管产品正常的生命周期。装在你手机里的模型没有状态页。
并排来看
本机应用 vs 云端转写服务
| 项目 | Murmur(本机) | 典型云端服务 |
|---|---|---|
| 转写在哪里发生 | 在你自己的设备上 | 在服务商的服务器上 |
| 录音是否上传 | 否 | 是 —— 它就是这么工作的 |
| 是否需要账号 | 不需要 | 通常需要 |
| 没信号能不能用 | 能,下载一次模型之后 | 不能 |
| 说话人标注 | 本机完成,跨录音记住同一个人 | 服务端,取决于套餐是否包含 |
| 文字稿翻译 | 本机逐行翻译 | 服务端,若有提供 |
| 转写手上已有的文件 | 可以,在本机处理 | 可以,需先上传 |
| 导出格式 | 纯文本、Markdown、PDF、Word | 因套餐而异 |
| 还有谁能读到文字稿 | 除非你分享,否则没有别人 | 你和服务商 |
| 服务故障或停运时 | 毫无影响,一切都在本地 | 你会失去访问权 |
留在本机要付出的代价
先说实话:本机模型必须装进手机的内存与功耗预算,所以在真正困难的音频上 —— 嘈杂的房间、很重的口音、三个人同时说话 —— 用一整机架加速卡跑更大模型的云端服务确实可能更准。Murmur 不假装这个差距不存在,而是在最要紧的地方把它补上:点任意一行就能只重放那一句来核对措辞,可以把某一行改判给正确的说话人,也可以重新学习一个人的声音,让下一次录音的结果更好。对于日常的会议、采访和讲座,这份文字稿是可以直接拿来干活的;真正关键的地方,几秒钟就能核实。
为什么说话人标注是另外一半
没有归属的文字稿,仍然是一堵需要你自己破译的文字墙。Murmur 按声音把对话切开、用颜色区分,并跨录音记住人,所以下周的会议回来时,同事的名字已经在上面了。这件事同样在设备上完成。它比听上去更要紧:一个人的声纹是生物特征数据,而最安全的存放处,就是当初生成它的那台设备。
什么情况下不该选本机方案
如果你要的是团队共享的工作区、多人实时协同编辑,或者一个把文字稿灌进数据仓库的 API,那么托管服务才是对的工具,这场对比根本不成立。Murmur 是为另一种场景造的:一个人、一台设备、不该被复制到任何地方的对话,以及一份可以导出为纯文本、Markdown、PDF 或 Word,带去任何地方的文字稿 —— 包括交给你自己信任的那个 AI 助手。
常见问题
本机与云端 — 常见问题
本机转写能达到云端的准确度吗?
Murmur 会不会把我的录音送到哪里去?
需要注册账号吗?
还能拿到摘要吗?
从你的下一段对话开始。
下载 Murmur,下载一次语音模型,之后的每一次录音都会在你自己的设备上完成转写——会议、访谈、课堂,还有散步时的灵感。
免费下载 · 无需账号 · 没信号也能用