Робочий процес обробки аудіо
Ви вже бачили, як імпортувати та змінювати один аудіофайл за допомогою PyDub. А що робити, якщо у вас є тека з кількома аудіофайлами, які потрібно конвертувати?
У цій вправі ми використаємо PyDub, щоб підготувати теку з файлами до використання з speech_recognition.
Ви з'ясували, що у файлів дзвінків клієнтів є 3 секунди шуму на початку, а гучність нижча, ніж могла б бути.
Щоб це виправити, ми застосуємо PyDub, щоб обрізати шум, підвищити рівень звуку та конвертувати їх у розширення .wav.
Ви можете прослухати неформатований приклад тут.
Ця вправа є частиною курсу
Обробка усного мовлення в Python
Інтерактивна практична вправа
Спробуйте виконати цю вправу, доповнивши цей зразок коду.
file_with_static = AudioSegment.from_file(____)
# Cut the first 3-seconds of static off
file_without_static = file_with_static[____:]