Úprava parametrů zvuku
Při průzkumné analýze dat můžeš zjistit, že některé parametry zvukových souborů se liší nebo nejsou kompatibilní s API pro rozpoznávání řeči.
Neboj se, PyDub má vestavěné funkce, které ti umožňují různé atributy měnit.
Například snímkovou frekvenci zvukového souboru nastavíš tak, že na instanci AudioSegment zavoláš set_frame_rate() a předáš jí celé číslo požadované frekvence v hertzích.
V tomto cvičení si vyzkoušíme úpravu několika zvukových atributů.
Toto cvičení je součástí kurzu
Zpracování mluveného jazyka v Pythonu
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Import audio file
wav_file = AudioSegment.from_file(file="wav_file.wav")
# Create a new wav file with adjusted frame rate
wav_file_16k = wav_file.____(____)
# Check the frame rate of the new wav file
print(wav_file_16k.____)