Рабочий процесс обработки аудио
Вы уже умеете импортировать и обрабатывать отдельный аудиофайл с помощью PyDub. Но что если у вас есть папка с несколькими файлами, которые нужно конвертировать?
В этом упражнении мы воспользуемся PyDub, чтобы подготовить набор файлов к использованию со speech_recognition.
Оказалось, что все файлы звонков клиентов содержат 3 секунды статического шума в начале и записаны тише, чем следует.
Чтобы исправить это, мы используем PyDub: вырежем шум, повысим громкость и конвертируем файлы в формат .wav.
Послушать пример необработанного файла можно здесь.
Это упражнение является частью курса
Обработка устной речи на Python
Интерактивное практическое упражнение
Попробуйте выполнить это упражнение, дополнив этот пример кода.
file_with_static = AudioSegment.from_file(____)
# Cut the first 3-seconds of static off
file_without_static = file_with_static[____:]