Začněte nyníZačněte zdarma

Parametry zvukových souborů v PyDubu

Každý zvukový soubor, se kterým budeš pracovat, má řadu vlastností – například počet kanálů, vzorkovací frekvenci (frame rate), šířku vzorku a další.

Znalost těchto parametrů je důležitá pro to, aby tvoje zvukové soubory splňovaly požadavky různých API pro přepis řeči.

Mnohá API například doporučují minimální vzorkovací frekvenci (wav_file.frame_rate) 16 000 Hz.

Když vytvoříš instanci AudioSegment, PyDub tyto parametry automaticky zjistí ze zvukového souboru a uloží je jako atributy.

V tomto cvičení si tyto atributy prozkoumáme.

Toto cvičení je součástí kurzu

Zpracování mluveného jazyka v Pythonu

Zobrazit kurz

Interaktivní cvičení na vyzkoušení si v praxi

Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.

# Import audio file
wav_file = AudioSegment.from_file(file="wav_file.wav")

# Find the frame rate
print(wav_file.____)
Upravit a spustit kód