НачатьНачать бесплатно

Рабочий процесс обработки аудио

Вы уже умеете импортировать и обрабатывать отдельный аудиофайл с помощью PyDub. Но что если у вас есть папка с несколькими файлами, которые нужно конвертировать?

В этом упражнении мы воспользуемся PyDub, чтобы подготовить набор файлов к использованию со speech_recognition.

Оказалось, что все файлы звонков клиентов содержат 3 секунды статического шума в начале и записаны тише, чем следует.

Чтобы исправить это, мы используем PyDub: вырежем шум, повысим громкость и конвертируем файлы в формат .wav.

Послушать пример необработанного файла можно здесь.

Это упражнение является частью курса

Обработка устной речи на Python

Посмотреть курс

Интерактивное практическое упражнение

Попробуйте выполнить это упражнение, дополнив этот пример кода.

file_with_static = AudioSegment.from_file(____)

# Cut the first 3-seconds of static off
file_without_static = file_with_static[____:]
Редактировать и запускать код