Pracovní postup pro zpracování zvuku
Viděl/a jsi, jak importovat a upravit jeden zvukový soubor pomocí PyDub. Co kdybys ale měl/a složku s více zvukovými soubory, které je potřeba převést?
V tomto cvičení použijeme PyDub k tomu, abychom připravili složku se soubory pro použití s speech_recognition.
Zjistil/a jsi, že všechny nahrávky zákaznických hovorů mají na začátku 3 sekundy šumu a jejich hlasitost je nižší, než by mohla být.
Aby ses s tím vypořádal/a, použijeme PyDub k oříznutí šumu, zvýšení hlasitosti a převodu souborů do formátu .wav.
Neformátovaný příklad si můžeš poslechnout zde.
Toto cvičení je součástí kurzu
Zpracování mluveného jazyka v Pythonu
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
file_with_static = AudioSegment.from_file(____)
# Cut the first 3-seconds of static off
file_without_static = file_with_static[____:]