用 AI 整理读书笔记、写一篇故事,或者把几份资料汇总成长文,现在已经不难了。但文稿写完以后,还有一个很实际的问题:什么时候读?
坐地铁时不想一直盯着屏幕,散步时不方便拿着手机,做家务时也腾不出手。这些时候,如果能把准备好的文稿变成音频,文字就多了一种使用方式。
我是「自听」MyListen 的开发者。做这款 iPhone 文字转语音 App,想解决的就是这件事:把自己准备好的内容放进手机里,生成音频,再找合适的时间听。这篇以「自听」为例,介绍从文稿到收听的几个步骤,以及其中需要注意的地方。
一、先准备一份适合听的文稿
能够阅读的内容,不一定适合直接朗读。
例如,AI 整理出来的资料可能有很多表格、编号和链接。看屏幕时可以来回对照,但听的时候,一旦连续出现几个没有解释的数字,就容易跟不上。
拿一份读书笔记来说,可以先做三处整理:
- 把表格改成完整句子,说明每个数字或观点对应什么。
- 将过长的段落按主题分开,让内容有清楚的转折。
- 把参考链接另行保存,避免一串网址混进朗读正文。
如果让 AI 帮忙调整,可以这样描述需求:
请把下面的文稿整理成适合收听的版本,保留原意和重要信息,不添加原文没有的事实。把表格改成连贯的句子,按主题分段,参考链接保留在文末。
整理后仍然需要自己检查。文字转语音只负责把内容读出来,不会替你判断 AI 写的事实是否准确,也不会自动修正文稿中的逻辑问题。
二、把正文放进「自听」
准备好文稿后,可以直接复制正文,粘贴到「自听」;如果已经保存为 TXT 或 Markdown 文件,也可以导入。
这里有个简单的取舍:如果只是想听正文,就不必把资料目录、参考网址和写作时的提示词一起放进去。保留原始文件,再单独准备一份朗读稿,后面修改也更方便。
这一步不需要重新录音。输入的是文字,接下来由语音模型生成声音。
三、选好声音,再开始生成
在「自听」里选好声音后,点击生成,稍等片刻,就能一边生成一边听。
对于长文,这样可以先听开头,再判断文稿是否适合继续。如果一开始就出现句子太长、标题反复打断内容,或者专有名词读起来不容易理解,可以先调整原文,再重新生成。
「自听」采用在 iPhone 本地运行的语音模型,语音合成不需要把文稿上传到云端 TTS 服务。不过,“本地生成”不等于没有等待时间,具体用时会受到手机型号、文稿长度和内容等因素影响。
另一个需要区分的地方是:如果前面的文稿是通过在线 AI 服务整理的,那么整理文稿和本地生成语音是两个独立步骤,不能把整个过程都称为离线处理。
四、把长文留给方便收听的时候
音频生成后,就可以在通勤、散步或做家务时接着听。需要保留音频文件时,「自听」也支持导出 M4A。
但听和读适合的内容并不完全一样。
连贯的故事、讲解稿、读书笔记,通常更容易通过收听理解;包含大量公式、代码、复杂表格,或者需要反复核对数字的资料,仍然更适合对着原文阅读。
因此,把文字变成音频,并不是为了替代所有阅读,而是给那些已经准备好、却暂时没有时间看的内容,多留一个入口。
五、使用前可以先想清楚的几个问题
如果你想把自己的文稿变成音频,可以先确认:
- 内容准备好了吗?文稿是否准确、连贯,比单纯把文字读出来更重要。
- 需要的是朗读还是创作?「自听」负责文字转语音,不负责替你写故事或搜集资讯。
- 是否适合只用耳朵理解?如果离开表格和图片就听不明白,可以保留阅读,或先重写朗读稿。
- 声音是否适合这份内容?自然度、语速感受和专有名词的读法,都值得先听一小段再判断。
「自听」围绕的需求很简单:你已经有了一份想看的内容,现在希望在不方便看屏幕的时候,也能把它听完。对于 AI 生成的长文,或者自己积累的笔记,这是一种把文稿继续用起来的方法。