听书(语音朗读)

雅典娜可以把你正在看的读给你听。默认用你手机自带的系统语音引擎,不用下模型、不用联网、也不花钱。只有系统引擎用不了时,才需要看下面的备选。

快速上手

1. 打开一份资料,呼出工具栏,点「听书」。

2. 可以调语速、换音色、设一个到点就停的睡眠定时。

3. EPUB 朗读时正在读的句子会高亮并跟着滚;PDF 只出声,页面上没有句子高亮。

4. 息屏和切到后台都能继续播。手机锁屏与通知栏上有播放控件,可以暂停、上一句 / 下一句,并显示当前的封面与章节。

如果听不了:先做语音自检

部分安卓手机(尤其是改过系统底层的国产机型)的语音引擎本身有问题。请到「设置 → 听书 → 语音自检」,雅典娜会真正播一句测试语音,并请你确认有没有听到——程序自己的检测在这些机型上并不可靠,你的耳朵才是最终判据。

自检会按成本从低到高给出路径:

1. 在应用内切换语音引擎。手机上装了不止一个引擎时,换一下即可,不用下载任何东西。这个切换只在雅典娜里生效,不动系统默认。

2. 下载缺失的语音数据。自检可以直接把你带到系统的语音数据安装界面。

3. 打开系统语音设置,检查默认引擎与语言包。

4. 配置云语音(见下一节)。

5. 以上都不行时,可以在应用商店里找一款第三方语音引擎(例如 MultiTTS)装上作为系统引擎。雅典娜不提供下载链接,也不对第三方应用的来源与安全性负责,请自行判断。

云语音:用你自己的 API Key

这是一个可选的高级功能,用来补系统引擎覆盖不到的设备和语言。它不会被设成默认;合成失败或断网时自动回到系统引擎,基础听书始终离线可用。

雅典娜支持两家服务商,在「设置 → 听书 → 云语音」里填入自己的 API Key 即可:

- 火山引擎豆包语音:中国大陆可直接连接,不用额外搭网络。内置官方 2.0 全部音色,覆盖 16 个语种。

- 微软 Azure 语音服务:面向海外,音色清单用你的 Key 自动拉官方全量,覆盖上百个语种。除 Key 之外还要填创建资源时选的区域(如 eastasia)。

关于音色与语言:两家能提供的音色我们全量列出,按语种分组,可以直接搜。你读什么语言就选对应语种的音色——这和雅典娜界面支持哪些语言无关。注册和付费之前,先到下面的官方文档确认你要的语言在不在该服务商的列表里。 Azure 有一条必须知道:音色语言和文本语言对不上时不会出声,但这次请求照样计费。选错不会报错,只会既没声音又扣了钱。

关于费用:这是你和服务商之间的直接付费,雅典娜不代收、不加价、也不设限额。两家口径不同——Azure 官方把每个中文字符按 2 个字符计费,读中文的实际费用是标示单价的两倍;火山按 1 个汉字算 1 个字符。朗读时界面会显示本次已合成的字符数,方便你对账。

关于安全:API Key 只保存在这台设备上,不同步、不上传到雅典娜的服务器。代价是换设备要重新填一次,好处是我们从不持有你的第三方付费凭证。已排除出系统备份与换机迁移,避免随云备份外流。

常见问题

云语音提示 resource not granted(火山):Key 有效但服务未开通,或所选音色没在控制台下单。请到火山控制台的开通管理里处理。「Key 有效」和「能合成」是两件事。

Azure 提示区域错误:区域必须和创建语音资源时选的完全一致。中国区(世纪互联)的资源请填 chinaeast2 等中国区区域名。

Azure 选了音色却完全没声音:多半是音色语种和这份资料的语言对不上。这种情况下 Azure 不出声,但该次请求仍然计费,请换成一致的音色。

语速拖动没反应:云语音的语速由服务商接口支持,两家都支持;若没变化,先确认当前是不是真的在用云语音(断网时会静默回到系统引擎)。

第一句要等一会儿:云语音需要一次网络往返,之后的句子会提前预取,听起来就连贯了。

官方文档

火山引擎豆包语音(音色清单与计费):https://www.volcengine.com/docs/6561/1257544

微软 Azure 语音服务(语言与音色支持):https://learn.microsoft.com/azure/ai-services/speech-service/language-support