Normalizace zvukového souboru pomocí PyDub
Někdy narazíš na zvukové soubory, kde je řeč na některých místech hlasitá a na jiných tichá. Taková nerovnoměrná hlasitost může ztížit přepis.
Naštěstí má modul effects v PyDub funkci normalize(), která najde maximální hlasitost AudioSegment a podle ní upraví zbytek záznamu. Tiché části tak dostanou hlasitostní boost.
Ukázku zvukového souboru, který začíná hlasitě a postupně ztichne – loud_then_quiet.wav – si můžeš poslechnout zde.
V tomto cvičení použiješ normalize() k vyrovnání hlasitosti souboru, takže bude znít přibližně takto.
Toto cvičení je součástí kurzu
Zpracování mluveného jazyka v Pythonu
Pokyny k cvičení
- Importuj
AudioSegmentzPyDubanormalizez modulu effects knihovnyPyDub. - Načti cílový zvukový soubor
loud_then_quiet.wava ulož ho do proměnnéloud_then_quiet. - Normalizuj načtený zvukový soubor pomocí funkce
normalize()a výsledek ulož donormalized_loud_then_quiet.
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Import AudioSegment and normalize
from pydub import ____
from pydub.effects import ____
# Import target audio file
loud_then_quiet = AudioSegment.from_file(____)
# Normalize target audio file
normalized_loud_then_quiet = ____(____)