Začněte nyníZačněte zdarma

Úprava parametrů zvuku

Při průzkumné analýze dat můžeš zjistit, že některé parametry zvukových souborů se liší nebo nejsou kompatibilní s API pro rozpoznávání řeči.

Neboj se, PyDub má vestavěné funkce, které ti umožňují různé atributy měnit.

Například snímkovou frekvenci zvukového souboru nastavíš tak, že na instanci AudioSegment zavoláš set_frame_rate() a předáš jí celé číslo požadované frekvence v hertzích.

V tomto cvičení si vyzkoušíme úpravu několika zvukových atributů.

Toto cvičení je součástí kurzu

Zpracování mluveného jazyka v Pythonu

Zobrazit kurz

Interaktivní cvičení na vyzkoušení si v praxi

Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.

# Import audio file
wav_file = AudioSegment.from_file(file="wav_file.wav")

# Create a new wav file with adjusted frame rate
wav_file_16k = wav_file.____(____)

# Check the frame rate of the new wav file
print(wav_file_16k.____)
Upravit a spustit kód