文本转语音与朗读
我们实测并排名了 65 款 Mac 文本转语音与朗读应用——更新于 2026年8月。
榜上每一款应用都在我们自己的 Apple 芯片 Mac 上实测,并按公开评分标准打分——能力、品质、隐私、性价比。测试全程监测网络行为。 评分标准 →
手头有一篇 PDF、一本电子书,或者一篇长文章,但你更想听而不是看——也许在通勤、做饭,也许眼睛累了,也许你需要一款 AAC 工具替你说话。不管哪种情况,核心需求都是:把文字变成自然的语音,在 Mac 上本地完成,不用把文档上传到任何地方,而且能处理你真正在用的格式。我们从功能、品质、隐私和性价比四个维度评估了 65 款 Mac 应用。有些用经典的系统语音,越来越多的应用开始在设备端运行真正的神经网络模型,输出明显更自然。以下是值得一试的应用排序。
完整排名 — 共 65 款
Proloquo2Go AAC
AssistiveWare B.V.标杆级符号式 AAC 应用,基于研究的核心词汇表搭配 100+ 自然设备端语音,完全离线可用。语音合成为经典 Acapela 而非神经网络 AI,但做工和深度无人能及。
” 内含 100+ 可下载的自然音色成人与儿童语音;词语预测 — 实测笔记
Narrly: Read Aloud PDF & Text
Beaver Dynamics Inc.多面手的免费朗读器,用设备端语音以 50+ 语言朗读 PDF、EPUB、Word、RTF、图片和网页。文档不会离开你的 Mac,还能导出音频随时收听。
” 语音在你的设备上合成;你的文档不会上传任何地方;可离线收听 — 实测笔记
Sandbook: Natural Voice Reader
SmashMelon LLC少有的真正在设备端运行神经网络 TTS 模型的应用,从 EPUB、PDF、TXT 文件生成富有情感的语音,不做云端处理。
” 逼真的设备端文本转语音(TTS)模型;不进行云端处理;在你的设备上运行大模型;一切都在设备上完成 — 实测笔记
Proloquo4Text AAC
AssistiveWare B.V.面向有读写能力用户的顶级 AAC 方案,单屏输入布局、自学习单词预测,以及 my-own-voice 语音留存功能——为正在失去嗓音的人保留自己声音的特质。
” 无需联网即可交流;my-own-voice 语音留存技术,将你自己声音的特质融入合成语音 — 实测笔记
Piper - Neural TTS
IHOR SHEVCHUK把真正的神经网络语音装到系统全局——VoiceOver、朗读内容、任意使用 macOS 语音合成的应用都能获得品质升级,下载模型后 100% 本地运行。
” 100% 本地且私密:所有语音合成完全在你的设备上进行。无云端处理……下载模型后无需联网 — 实测笔记
Pictello Visual Stories
AssistiveWare B.V.小众但做工讲究的 AssistiveWare 叙事工具,把照片和视频与文字转语音结合,用于构建社交故事和识字资源,配逐词高亮、单词预测和 110+ 离线语音,覆盖 29 种语言。
” 可从 29 种语言的 110+ 免费文字转语音语音中选择;内置单词预测和边打边读 — 实测笔记
Text to Speech PDF Reader
Bret Lester专注的 PDF 朗读工具,配单词高亮、自动滚动、位置记忆和标注保存。研读 PDF 很好用,支持多语言和可选同步,但完整体验锁在每年 9.99 美元的订阅之后。
” 可免费在你的设备上下载更多语音 — 实测笔记
KO Reader
James Carrell II用 53 种 Kokoro 神经语音为文章、EPUB 和 PDF 配音,可导出 m4a/m4b 有声书文件;一次性下载模型后完全离线,3.99 美元一次性买断。
” 100% 设备端 TTS;由开源 Kokoro TTS 模型驱动;一次性下载模型后无需联网 — 实测笔记
PageEcho - AI Text Reader
harim kang在私密的电子书阅读器里把设备端神经 TTS(Supertonic、Kokoro)与离线 Apple Intelligence 摘要、问答和思维导图打包在一起——一套丰富的本地 AI 组合,无服务器、无追踪。
” 完全设备端的电子书阅读器,配离线 AI 和自然文字转语音;由 Supertonic、Kokoro 和 Apple 系统语音驱动;所有 AI 功能本地运行 — 实测笔记
SRT Speaker subtitles to audio
Alexei Shechkov把 SRT、VTT 字幕文件转成同步配音轨道,通过 Apple Speech 框架使用设备端系统语音合成,支持语速控制、双遍计时和批量处理,面向配音和译制工作流。
” 应用使用用户设备上安装的 TTS 引擎 — 实测笔记
如何挑选 Mac 文本转语音与朗读应用
先看你要朗读什么。如果日常处理 PDF 和电子书,选支持 EPUB、PDF、网页原生解析的应用——Narrly 格式覆盖最广且免费;如果你需要逐词高亮和位置记忆来精读 PDF,Text to Speech PDF Reader 做得最扎实。如果你需要 AAC 辅助沟通工具,Proloquo2Go 和 Proloquo4Text 才是真正为此设计的,内置词汇体系和单词预测,通用朗读器做不到。接下来想清楚语音质量对你有多重要。用 Apple 内置系统语音的应用到处都能稳定运行,但声音偏合成感;运行 Kokoro、Piper 等神经网络模型的应用输出更富表现力,但对 GPU 和内存要求也更高。隐私方面这个类别比较简单:大多数应用默认在设备上合成语音,文档留在本地,联网操作只有你主动选择的——比如下载语音包。最后看价格。Narrly、Piper 等免费选项很强,高端 AAC 工具价格更高,但专业级语音和无障碍功能对每天依赖它们的用户来说物有所值。
常见问题
Mac 上能把文字转语音的结果导出成 MP3 或有声书文件吗?
可以。Narrly 支持从 PDF 和电子书导出音频,KO Reader 可导出 m4a 和 m4b 有声书文件,SRT Speaker 能批量将字幕文件转成同步音轨。这些应用都在设备端合成语音,转换过程中你的文档不会离开 Mac。
系统语音和设备端神经网络语音有什么区别?
系统语音是 macOS 内置的语音引擎,速度快、稳定、到处能用,但听感偏机械。神经网络设备端语音——Sandbook、Piper、KO Reader 等应用提供——在 Mac 的 GPU 上本地运行训练好的 AI 模型,输出更自然、更有表现力。代价是资源占用更高,部分机型上会有明显发热。
这些文字转语音应用能离线使用吗?
大多数可以。Piper、Sandbook、Narrly 在一次性下载语音后完全在设备端合成。AAC 工具 Proloquo2Go 和 Proloquo4Text 同样不需要联网。少数应用在本地引擎之外提供可选的云端语音,但核心朗读功能通常都是离线的。