ПочатиПочніть безкоштовно

Робочий процес обробки аудіо

Ви вже бачили, як імпортувати та змінювати один аудіофайл за допомогою PyDub. А що робити, якщо у вас є тека з кількома аудіофайлами, які потрібно конвертувати?

У цій вправі ми використаємо PyDub, щоб підготувати теку з файлами до використання з speech_recognition.

Ви з'ясували, що у файлів дзвінків клієнтів є 3 секунди шуму на початку, а гучність нижча, ніж могла б бути.

Щоб це виправити, ми застосуємо PyDub, щоб обрізати шум, підвищити рівень звуку та конвертувати їх у розширення .wav.

Ви можете прослухати неформатований приклад тут.

Ця вправа є частиною курсу

Обробка усного мовлення в Python

Переглянути курс

Інтерактивна практична вправа

Спробуйте виконати цю вправу, доповнивши цей зразок коду.

file_with_static = AudioSegment.from_file(____)

# Cut the first 3-seconds of static off
file_without_static = file_with_static[____:]
Редагувати та запускати код