语音输入的写作工作流
今天看到一个帖子,作者说通过语音输入写日记,可以提高自己的语言表达能力。
他说,一开始使用语音输入的时候,会遇到很多问题,比如输入之后还需要不断调整语序或者表达。因为我们已经习惯了打字,打字的时候可以一边思考一边修改,反复推敲之后再输入;而语音输入则要求人能够更快地组织语言,把脑子里的想法直接说出来。帖子里还说,经过一段时间的训练,这种修改会越来越少,人的语言表达能力也会有明显提高。
我觉得他说得很有道理。
仔细想想,这其实和练吉他的时候录音、录像很像。录下来之后,你会得到一个非常直接的反馈,知道自己的表达有没有问题,思路是不是太跳,或者有没有一些自己没有意识到的表达习惯。通过这样的反馈,再去调整自己的思维逻辑和表达方式,表达能力自然也会慢慢提高。不过我觉得,这篇帖子真正有意思的地方,不只是“语音输入可以提高表达能力”,更在于它让我重新意识到,语音输入本身就是一种很好的文字输入方式。
其实本科的时候,我就已经开始这么做了。那时候写《近代史纲要》或者其他课的大作业,经常都要写很长的文章。如果完全靠打字,对当时的我来说太慢了,所以我经常会用微信语音转文字,把自己的想法先快速说出来,再整理成文章。那个时候还没有 AI,虽然已经可以很快得到文字,但后面的修改、润色基本都只能自己完成。现在就不一样了。我更倾向于先用中文或者英文,把大概意思表达出来,不去咬文嚼字,只要能够把自己的想法完整输出,后面再交给 AI,让它帮我修改到能够准确、自然、得体地表达,然后再用于邮件、Blog 或者其他正式一点的场景。回过头来看,其实就是把以前和现在两种方式结合在了一起:语音输入负责快速输出想法,AI 负责整理表达。我觉得这是一个效率很高的工作流,而且不仅适用于写日记,也适用于任何需要输出大段文字的时候。
更有意思的是,它不仅限于中文。我完全可以用英语,甚至德语进行语音输入,把它当作一种语言训练。我一直觉得自己的英语表达有很多废话,也不够简洁。如果一直这样练,再结合 AI 给出的反馈,我觉得也是一种训练表达能力的方法。
语音输入对我来说还有一个很大的好处。回家以后,除了和铭书打电话,我基本上没有什么交流的对象,而语音输入给了我一个把想法说出来的机会。很多原本只是在脑子里的东西,可以真的 speak out。另外,语音输入比打字和手写快得多,基本能够跟上我思考的速度。而且最后保存下来的只是文本,我可以直接用 Markdown 保存自己的输出,不需要像录视频或者录音一样保存很大的文件,以后想重新看,也不用再做语音转文字或者剪辑这些额外的工作。
当然,这也不是完全没有缺点。语音输入虽然能够提高输入速度,但也可能会留下更多废话。我这里说的“贬值”,不是价值上的贬值,而是语言更容易停留在意识流的状态。打字或者手写的时候,人会一直停下来想:这句话有没有必要?这个词是不是最准确?其实在输入之前就已经完成了一轮筛选。而语音输入更关注的是把想法快速记录下来,所以很多本来会删掉的话,也会一起保留下来。不过还是要看目的。如果只是想记录当下的想法,我觉得语音输入反而更好,因为它几乎不会打断思路;如果需要正式、精准一点的表达,那后面还是需要再整理,或者交给 AI 去润色。
这也让我想到,我之前一直想尝试用 Vlog 的方式记录生活。现在想想,语音输入其实是一种成本更低的记录方式。这里说的“成本低”,不是说它低级,而是整个记录过程的成本都更低。不用拍摄,不用保存大量视频,也不用剪辑。更重要的是,回看的成本也低很多。如果我拍了二十分钟的视频,那我想重新看,就还需要二十分钟;如果只是文本,即使里面有一些废话,我也可以很快浏览完整篇内容,阅读速度肯定比看视频快得多。
最近我买了 DJI Mic Mini 2,发现它不仅可以通过接收器连接设备,也可以直接通过蓝牙连接手机,甚至电脑。这样一来,我几乎可以随时开始语音输入。我试了一下,它甚至可以在很轻、接近耳语的声音下正常识别,收音效果比我想象中还要好。
我现在把它连接到电脑作为音频输入,电脑的音频输出通过 3.5 mm 接到数字效果器上。效果器一方面负责我的吉他和伴奏输出,另一方面还有一个耳机输出口。我在这个输出口接了一根一分二的线,一路接耳机监听,另一路接到相机。这样,相机录下来的就是效果器混合之后的声音,不需要后期再去同步音频。
以前我总觉得,记录生活要么写日记,要么拍 Vlog。现在看来,中间其实还有一种形式:想到什么,就说出来,把它变成文字。它没有视频那么完整,也没有手写那么有仪式感,但足够快、足够轻,也足够让我把那些原本可能会忘掉的想法留下来。也许以后,我的很多 Blog 都会是这样写出来的。