Прослушивание (синтез речи)

Athena может читать вслух то, что вы смотрите. По умолчанию используется встроенный речевой движок вашего телефона — без загрузки моделей, без сети, без затрат. Альтернативы ниже нужны только в том случае, если этот движок на вашем устройстве не работает.

С чего начать

1. Откройте книгу, вызовите панель инструментов и нажмите «Слушать».

2. Настройте скорость, выберите голос и задайте таймер сна, если хотите, чтобы воспроизведение остановилось само.

3. В EPUB читаемое предложение подсвечивается, и страница прокручивается вместе с ним. PDF читаются вслух без подсветки на странице.

4. Воспроизведение продолжается при выключенном экране и когда Athena в фоне. На экране блокировки и в шторке уведомлений показываются обложка и глава, с кнопками паузы и перехода на предложение назад или вперёд.

Если не работает: запустите самопроверку речи

На некоторых телефонах Android — особенно на моделях, где производитель изменил системный речевой слой, — речевой движок неисправен. Откройте Настройки → Прослушивание → Самопроверка речи. Athena действительно воспроизведёт тестовую фразу и спросит, услышали ли вы её: программные проверки на таких устройствах ненадёжны, поэтому окончательный судья — ваш слух.

Затем самопроверка предложит целевые исправления, начиная с самых простых:

1. Переключить движок внутри Athena. Если на телефоне установлено несколько речевых движков, достаточно переключиться — ничего скачивать не нужно. Переключение действует только внутри Athena и не меняет системный движок по умолчанию.

2. Скачать недостающие голосовые данные. Самопроверка может сразу перевести вас в системный установщик голосовых данных.

3. Открыть системные настройки речи, чтобы проверить движок по умолчанию и языковые пакеты.

4. Настроить облачные голоса (см. ниже).

5. Если ничего не помогло, можно найти сторонний речевой движок в магазине приложений (например, MultiTTS) и установить его как системный. Athena не даёт ссылок на загрузку и не несёт ответственности за источник и безопасность сторонних приложений; пожалуйста, оценивайте их самостоятельно.

Облачные голоса: используйте собственный API-ключ

Это необязательная расширенная функция, закрывающая пробелы, с которыми не справляется системный движок — на определённых устройствах или для определённых языков. Она никогда не становится вариантом по умолчанию, и при сбое синтеза или потере соединения Athena автоматически возвращается к системному движку — базовое прослушивание всегда работает офлайн.

Поддерживаются два провайдера. Вы лишь вводите собственный API-ключ в Настройки → Прослушивание → Облачные голоса:

- Volcano Engine (Doubao): напрямую доступен из материкового Китая без дополнительной настройки сети. Встроен полный официальный каталог голосов 2.0, охватывающий 16 языков.

- Microsoft Azure Speech: для всех остальных регионов. Список голосов загружается с вашим ключом из полного официального каталога, охватывающего сотни языков. Помимо ключа нужно ввести регион, выбранный при создании ресурса (например, eastasia).

О голосах и языках: мы показываем всё, что предлагают оба провайдера, с группировкой по языкам и поиском. Выберите голос на языке того, что вы читаете — это никак не связано с тем, какие языки поддерживает интерфейс Athena. Прежде чем регистрироваться или платить, проверьте по официальной документации ниже, что ваш язык есть в списке этого провайдера. Одно правило Azure стоит знать заранее: если язык голоса не совпадает с текстом, ничего не произносится, но запрос всё равно тарифицируется. Неверно выбранный голос не вызывает ошибки — вы просто получаете тишину и списание.

О стоимости: вы платите провайдеру напрямую. Athena ничего не собирает, не делает наценок и не устанавливает лимитов. Учтите, что провайдеры тарифицируют по-разному — Azure официально считает каждый китайский иероглиф за два символа, поэтому китайский текст стоит вдвое дороже указанного тарифа, а Volcano считает один иероглиф за один символ. Число символов, синтезированных за текущий сеанс, показывается в приложении, чтобы вы могли сверить расходы.

О безопасности: ваш API-ключ хранится только на этом устройстве. Он никогда не синхронизируется и не загружается на серверы Athena. Цена этого — повторный ввод на новом устройстве; выгода — мы никогда не храним ваши платёжные учётные данные для сторонних служб. Ключ также исключён из системного резервного копирования и переноса между устройствами, поэтому не может утечь через облачную резервную копию.

Устранение неполадок

«resource not granted» (Volcano): ключ действителен, но служба не включена или выбранный голос не приобретён в консоли. Разберитесь с этим в разделе управления службами консоли Volcano. Действующий ключ и работающий синтез — разные вещи.

Ошибка региона Azure: регион должен в точности совпадать с выбранным при создании ресурса Speech. Для ресурсов Azure China (21Vianet) используйте китайское имя региона, например chinaeast2.

Azure вообще не воспроизводит звук: скорее всего, язык голоса не совпадает с текстом. В этом случае Azure молчит, но запрос тарифицируется — переключитесь на подходящий голос.

Ползунок скорости не действует: оба провайдера поддерживают скорость. Если ничего не меняется, сначала убедитесь, что облачные голоса действительно используются — офлайн Athena незаметно возвращается к системному движку.

Первое предложение звучит с задержкой: облачному синтезу нужен один сетевой запрос. Следующие предложения подгружаются заранее, поэтому воспроизведение становится непрерывным.

Официальная документация

Синтез речи Volcano Engine Doubao (список голосов и тарифы): https://www.volcengine.com/docs/6561/1257544

Microsoft Azure Speech (поддержка языков и голосов): https://learn.microsoft.com/azure/ai-services/speech-service/language-support