Začněte nyníZačněte zdarma

Normalizace zvukového souboru pomocí PyDub

Někdy narazíš na zvukové soubory, kde je řeč na některých místech hlasitá a na jiných tichá. Taková nerovnoměrná hlasitost může ztížit přepis.

Naštěstí má modul effects v PyDub funkci normalize(), která najde maximální hlasitost AudioSegment a podle ní upraví zbytek záznamu. Tiché části tak dostanou hlasitostní boost.

Ukázku zvukového souboru, který začíná hlasitě a postupně ztichne – loud_then_quiet.wav – si můžeš poslechnout zde.

V tomto cvičení použiješ normalize() k vyrovnání hlasitosti souboru, takže bude znít přibližně takto.

Toto cvičení je součástí kurzu

Zpracování mluveného jazyka v Pythonu

Zobrazit kurz

Pokyny k cvičení

  • Importuj AudioSegment z PyDub a normalize z modulu effects knihovny PyDub.
  • Načti cílový zvukový soubor loud_then_quiet.wav a ulož ho do proměnné loud_then_quiet.
  • Normalizuj načtený zvukový soubor pomocí funkce normalize() a výsledek ulož do normalized_loud_then_quiet.

Interaktivní cvičení na vyzkoušení si v praxi

Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.

# Import AudioSegment and normalize
from pydub import ____
from pydub.effects import ____

# Import target audio file
loud_then_quiet = AudioSegment.from_file(____)

# Normalize target audio file
normalized_loud_then_quiet = ____(____)
Upravit a spustit kód