1. Learn
  2. /
  3. Курси
  4. /
  5. Обробка усного мовлення в Python

Connected

Вправа

Нормалізація аудіофайла за допомогою PyDub

Іноді трапляються аудіофайли, де в одних місцях мовлення гучне, а в інших — тихе. Така різниця в гучності може заважати транскрибуванню.

На щастя, у модулі ефектів PyDub є функція normalize(), яка знаходить максимальну гучність AudioSegment, а потім підлаштовує решту AudioSegment пропорційно. Це означає, що тихі частини стануть голоснішими.

Ви можете прослухати приклад аудіофайла, який починається гучно, а потім стихає — loud_then_quiet.wav — тут.

У цій вправі ви використаєте normalize(), щоб вирівняти гучність нашого файла — щоб він звучав приблизно так.

Інструкції

100 XP
  • Імпортуйте AudioSegment з PyDub і normalize з модуля ефектів PyDub.
  • Імпортуйте цільовий аудіофайл loud_then_quiet.wav і збережіть його в loud_then_quiet.
  • Нормалізуйте імпортований аудіофайл за допомогою функції normalize() і збережіть результат у normalized_loud_then_quiet.