Аудио


НАЧАЛО >> Электронная библиотека >> Руководство администратора модуля FT >> Настройка модуля и параметров отображения >> Аудио📄 Скачать в DOCX


Настройки для работы с аудиофайлами в электронной библиотеке.

Внимание: Для обеспечения кроссбраузерного воспроизведения загруженные аудиофайлы автоматически конвертируются в форматы MP3 и OGG. Как и в случае с видео, для этого требуется работа утилит ffmpeg. При развертывании на Linux-сервере обязательно убедитесь, что бинарным файлам в папке bin/nix64/ffmpeg/ выданы права на исполнение (chmod +x).

1. Настройка подсистемы транскрибации

Параметры автоматического преобразования речи в текст находятся в настройках модуля FT, в блоке Преобразование голоса в текст (транскрибация). Поддерживаются локальный сервис Whisper и Yandex Speech API; отдельный модуль Transcribation для этого сценария больше не используется.

Требования к сервисам: Для локального Whisper на сервере должны быть доступны исполняемые файлы whisper-cli и выбранная модель в каталоге modules/FT/bin/data/whisper/. Для Yandex Speech API нужно заполнить параметры бакета и сервисного ключа; использование сервисов Yandex Cloud может быть тарифицируемым и требует настроенного платежного аккаунта.

При локальном распознавании модуль автоматически подготавливает аудио в файл forTranscribation.wav и сохраняет результаты Whisper в форматах JSON, SRT и VTT. Для Yandex Speech API используется подготовленный файл forTranscribation.ogg.

Подробнее см. раздел Транскрибация аудио и видео.