听书(语音朗读)
雅典娜可以把你正在看的读给你听。默认用你手机自带的系统语音引擎,不用下模型、不用联网、也不花钱。只有系统引擎用不了时,才需要看下面的备选。
快速上手
1. 打开一份资料,呼出工具栏,点「听书」。
2. 可以调语速、换音色、设一个到点就停的睡眠定时。
3. EPUB 朗读时正在读的句子会高亮并跟着滚;PDF 只出声,页面上没有句子高亮。
4. 息屏和切到后台都能继续播。手机锁屏与通知栏上有播放控件,可以暂停、上一句 / 下一句,并显示当前的封面与章节。
如果听不了:先做语音自检
部分安卓手机(尤其是改过系统底层的国产机型)的语音引擎本身有问题。请到「设置 → 听书 → 语音自检」,雅典娜会真正播一句测试语音,并请你确认有没有听到——程序自己的检测在这些机型上并不可靠,你的耳朵才是最终判据。
自检会按成本从低到高给出路径:
1. 在应用内切换语音引擎。手机上装了不止一个引擎时,换一下即可,不用下载任何东西。这个切换只在雅典娜里生效,不动系统默认。
2. 下载缺失的语音数据。自检可以直接把你带到系统的语音数据安装界面。
3. 打开系统语音设置,检查默认引擎与语言包。
4. 配置云语音(见下一节)。
5. 以上都不行时,可以在应用商店里找一款第三方语音引擎(例如 MultiTTS)装上作为系统引擎。雅典娜不提供下载链接,也不对第三方应用的来源与安全性负责,请自行判断。
云语音:用你自己的 API Key
这是一个可选的高级功能,用来补系统引擎覆盖不到的设备和语言。它不会被设成默认;合成失败或断网时自动回到系统引擎,基础听书始终离线可用。
雅典娜支持两家服务商,在「设置 → 听书 → 云语音」里填入自己的 API Key 即可:
- 火山引擎豆包语音:中国大陆可直接连接,不用额外搭网络。内置官方 2.0 全部音色,覆盖 16 个语种。
- 微软 Azure 语音服务:面向海外,音色清单用你的 Key 自动拉官方全量,覆盖上百个语种。除 Key 之外还要填创建资源时选的区域(如 eastasia)。
关于音色与语言:两家能提供的音色我们全量列出,按语种分组,可以直接搜。你读什么语言就选对应语种的音色——这和雅典娜界面支持哪些语言无关。注册和付费之前,先到下面的官方文档确认你要的语言在不在该服务商的列表里。 Azure 有一条必须知道:音色语言和文本语言对不上时不会出声,但这次请求照样计费。选错不会报错,只会既没声音又扣了钱。
关于费用:这是你和服务商之间的直接付费,雅典娜不代收、不加价、也不设限额。两家口径不同——Azure 官方把每个中文字符按 2 个字符计费,读中文的实际费用是标示单价的两倍;火山按 1 个汉字算 1 个字符。朗读时界面会显示本次已合成的字符数,方便你对账。
关于安全:API Key 只保存在这台设备上,不同步、不上传到雅典娜的服务器。代价是换设备要重新填一次,好处是我们从不持有你的第三方付费凭证。已排除出系统备份与换机迁移,避免随云备份外流。
常见问题
云语音提示 resource not granted(火山):Key 有效但服务未开通,或所选音色没在控制台下单。请到火山控制台的开通管理里处理。「Key 有效」和「能合成」是两件事。
Azure 提示区域错误:区域必须和创建语音资源时选的完全一致。中国区(世纪互联)的资源请填 chinaeast2 等中国区区域名。
Azure 选了音色却完全没声音:多半是音色语种和这份资料的语言对不上。这种情况下 Azure 不出声,但该次请求仍然计费,请换成一致的音色。
语速拖动没反应:云语音的语速由服务商接口支持,两家都支持;若没变化,先确认当前是不是真的在用云语音(断网时会静默回到系统引擎)。
第一句要等一会儿:云语音需要一次网络往返,之后的句子会提前预取,听起来就连贯了。
官方文档
火山引擎豆包语音(音色清单与计费):https://www.volcengine.com/docs/6561/1257544
微软 Azure 语音服务(语言与音色支持):https://learn.microsoft.com/azure/ai-services/speech-service/language-support