最近重新开始使用语音输入,主要是因为我发现:很多想法不是没有,而是记录成本太高,最后直接消失了。
很多想法消失在输入之前
我平时经常使用微信读书。读到一段有感触的内容时,我通常会产生一些联想,可能和工作有关,也可能和生活、过去的经历有关。
但以前如果想把这些想法记录下来,就需要停下来拿手机或 iPad 打字。躺在床上看书时不方便输入,使用 iPad 时切换阅读和输入也不够顺畅,一段复杂的想法还需要花很长时间才能打出来。
除了读书,走在路上突然想到一个问题、看完一部剧产生新的感受,或者和朋友聊天结束后获得新的启发,也都是我想记录的时刻。
过去我总想着"等之后有时间再记下来",但真正坐到电脑前时,那个想法往往已经不完整了,甚至完全忘记了。
我慢慢意识到,很多人不是没有想法,而是从想法出现,到它真正变成文字,中间的成本太高。打开设备、找到输入框、组织语言、修改错别字,每一步都可能让灵感消失。
我曾经放弃过语音输入
其实我以前尝试过语音输入,但当时的体验并不好。
一方面,识别准确率不够高;另一方面,如果连续说一大段内容,中途出现 Bug、误操作或其他问题,之前说了很久的内容可能会全部消失。
那时我觉得语音输入不够稳定。键盘输入虽然慢,但至少每输入一部分都能看见,也更容易控制。后来也有朋友不断推荐我继续尝试,但我一直没有真正重新使用。
直到最近,我开始通过语音和 ChatGPT、Codex 进行交互,才发现现在的语音识别体验已经发生了很大变化:识别速度很快,准确度也很高。说完之后,AI 还可以继续帮我整理结构、提炼重点。
这次体验让我觉得,语音输入不是键盘输入的简单替代,而是打开了一种新的表达方式。
先说出来,再慢慢整理
我现在的记录方式变成了:
text
产生想法
↓
直接用语音说出来
↓
AI 转写、整理和提炼
↓
保存、分享,或继续加工
我不需要一开始就把想法组织得很完整,也不需要先写成一篇文章。哪怕表达得很乱,也可以先把它留下来,之后再让 AI 帮我整理。
我正在体验的三个工具
目前我准备体验三个语音输入工具:Typeless、微信输入法和豆包输入法。
- Typeless :更像是带有 AI 整理能力的语音输入工具。免费版每周有 8,000 个单词额度;Pro 年付每月 12 美元,月付每月 30 美元。我会重点观察它的识别准确度、标点处理和语句整理能力,具体价格以官方定价页为准。
- 微信输入法:更适合聊天、搜索和快速记录等日常场景。
- 豆包输入法:同样提供语音输入和文本整理能力,我会把它和前两个工具进行比较。
我暂时不会只凭刚开始的体验给它们排名,而是准备分别使用一段时间,再比较识别准确度、长段语音稳定性、标点段落和整体输入效率。
语音输入带来的改变
对我来说,语音输入最明显的好处有三个。
第一,速度更快。它更接近自然表达,尤其适合记录一大段还没有整理好的想法。
第二,降低了记录门槛。以前我会因为"不方便""太麻烦"或者"这个想法还不够完整"而放弃记录。现在只要先说出来,就已经完成了最重要的一步。
第三,让记录变得更加连续。很多灵感并不是在书桌前出现的,而是在走路、看书、看剧或和朋友聊天时突然出现。只要环境允许,我就可以先用语音把它留下来。
当然,图书馆、会议现场或需要保持安静的地方,键盘输入仍然更合适。语音输入也不能代替休息,长时间说话会让嗓子疲惫,所以方便并不意味着需要一直输出。
还有一个意外收获:语音输入也能帮助我发现英语发音问题。日常表达中经常会出现中英文混合,如果某些英文单词总是无法被准确识别,我可以把它们记下来,再去确认发音和用法。
这样,语音输入就不只是记录工具,也成为英语学习中的一个反馈环节。
工具变得简单之后,什么最重要?
从写日记、写文档、记录读书笔记,到和 AI 交互、发送消息、完成文章初稿,只要是需要输入文字的场合,都可以把语音作为键盘之外的选择。具体是否使用,仍然取决于当时的环境;在图书馆、会议现场等需要保持安静的地方,键盘输入更合适。
工具可以降低表达和记录的成本,但真正有价值的内容,仍然来自个人的经历、观察、认知和思考。工具变得越来越简单之后,如何观察生活、形成判断,以及想要表达什么,可能才是更重要的事情。