Прослушивание (синтез речи)
Athena может читать вслух то, что вы смотрите. По умолчанию используется встроенный речевой движок вашего телефона — без загрузки моделей, без сети, без затрат. Альтернативы ниже нужны только в том случае, если этот движок на вашем устройстве не работает.
С чего начать
1. Откройте книгу, вызовите панель инструментов и нажмите «Слушать».
2. Настройте скорость, выберите голос и задайте таймер сна, если хотите, чтобы воспроизведение остановилось само.
3. В EPUB читаемое предложение подсвечивается, и страница прокручивается вместе с ним. PDF читаются вслух без подсветки на странице.
4. Воспроизведение продолжается при выключенном экране и когда Athena в фоне. На экране блокировки и в шторке уведомлений показываются обложка и глава, с кнопками паузы и перехода на предложение назад или вперёд.
Если не работает: запустите самопроверку речи
На некоторых телефонах Android — особенно на моделях, где производитель изменил системный речевой слой, — речевой движок неисправен. Откройте Настройки → Прослушивание → Самопроверка речи. Athena действительно воспроизведёт тестовую фразу и спросит, услышали ли вы её: программные проверки на таких устройствах ненадёжны, поэтому окончательный судья — ваш слух.
Затем самопроверка предложит целевые исправления, начиная с самых простых:
1. Переключить движок внутри Athena. Если на телефоне установлено несколько речевых движков, достаточно переключиться — ничего скачивать не нужно. Переключение действует только внутри Athena и не меняет системный движок по умолчанию.
2. Скачать недостающие голосовые данные. Самопроверка может сразу перевести вас в системный установщик голосовых данных.
3. Открыть системные настройки речи, чтобы проверить движок по умолчанию и языковые пакеты.
4. Настроить облачные голоса (см. ниже).
5. Если ничего не помогло, можно найти сторонний речевой движок в магазине приложений (например, MultiTTS) и установить его как системный. Athena не даёт ссылок на загрузку и не несёт ответственности за источник и безопасность сторонних приложений; пожалуйста, оценивайте их самостоятельно.
Облачные голоса: используйте собственный API-ключ
Это необязательная расширенная функция, закрывающая пробелы, с которыми не справляется системный движок — на определённых устройствах или для определённых языков. Она никогда не становится вариантом по умолчанию, и при сбое синтеза или потере соединения Athena автоматически возвращается к системному движку — базовое прослушивание всегда работает офлайн.
Поддерживаются два провайдера. Вы лишь вводите собственный API-ключ в Настройки → Прослушивание → Облачные голоса:
- Volcano Engine (Doubao): напрямую доступен из материкового Китая без дополнительной настройки сети. Встроен полный официальный каталог голосов 2.0, охватывающий 16 языков.
- Microsoft Azure Speech: для всех остальных регионов. Список голосов загружается с вашим ключом из полного официального каталога, охватывающего сотни языков. Помимо ключа нужно ввести регион, выбранный при создании ресурса (например, eastasia).
О голосах и языках: мы показываем всё, что предлагают оба провайдера, с группировкой по языкам и поиском. Выберите голос на языке того, что вы читаете — это никак не связано с тем, какие языки поддерживает интерфейс Athena. Прежде чем регистрироваться или платить, проверьте по официальной документации ниже, что ваш язык есть в списке этого провайдера. Одно правило Azure стоит знать заранее: если язык голоса не совпадает с текстом, ничего не произносится, но запрос всё равно тарифицируется. Неверно выбранный голос не вызывает ошибки — вы просто получаете тишину и списание.
О стоимости: вы платите провайдеру напрямую. Athena ничего не собирает, не делает наценок и не устанавливает лимитов. Учтите, что провайдеры тарифицируют по-разному — Azure официально считает каждый китайский иероглиф за два символа, поэтому китайский текст стоит вдвое дороже указанного тарифа, а Volcano считает один иероглиф за один символ. Число символов, синтезированных за текущий сеанс, показывается в приложении, чтобы вы могли сверить расходы.
О безопасности: ваш API-ключ хранится только на этом устройстве. Он никогда не синхронизируется и не загружается на серверы Athena. Цена этого — повторный ввод на новом устройстве; выгода — мы никогда не храним ваши платёжные учётные данные для сторонних служб. Ключ также исключён из системного резервного копирования и переноса между устройствами, поэтому не может утечь через облачную резервную копию.
Устранение неполадок
«resource not granted» (Volcano): ключ действителен, но служба не включена или выбранный голос не приобретён в консоли. Разберитесь с этим в разделе управления службами консоли Volcano. Действующий ключ и работающий синтез — разные вещи.
Ошибка региона Azure: регион должен в точности совпадать с выбранным при создании ресурса Speech. Для ресурсов Azure China (21Vianet) используйте китайское имя региона, например chinaeast2.
Azure вообще не воспроизводит звук: скорее всего, язык голоса не совпадает с текстом. В этом случае Azure молчит, но запрос тарифицируется — переключитесь на подходящий голос.
Ползунок скорости не действует: оба провайдера поддерживают скорость. Если ничего не меняется, сначала убедитесь, что облачные голоса действительно используются — офлайн Athena незаметно возвращается к системному движку.
Первое предложение звучит с задержкой: облачному синтезу нужен один сетевой запрос. Следующие предложения подгружаются заранее, поэтому воспроизведение становится непрерывным.
Официальная документация
Синтез речи Volcano Engine Doubao (список голосов и тарифы): https://www.volcengine.com/docs/6561/1257544
Microsoft Azure Speech (поддержка языков и голосов): https://learn.microsoft.com/azure/ai-services/speech-service/language-support