Příprava audio souborů pro klasifikaci textu
Acme jsou tvou prací nadšení a poslali ti další dvě složky s audio soubory.
První složka se jmenuje pre_purchase a obsahuje nahrávky zákazníků před nákupem, například pre_purchase_audio_25.mp3 (soubor).
Druhá složka se jmenuje post_purchase a obsahuje nahrávky zákazníků po nákupu, například post_purchase_audio_27.mp3 (soubor).
Po prozkoumání souborů zjistíš, že v každé složce je přibližně 50 nahrávek ve formátu .mp3.
Acme by chtěli vědět, jestli dokážeš sestavit klasifikátor pro kategorizaci budoucích hovorů. A ty jim potvrdíš, že to zvládneš.
V tomto cvičení proto projdeš obě složky a převedeš audio soubory do formátu .wav pomocí funkce convert_to_wav(), abys je mohl/a přepsat do textu.
Toto cvičení je součástí kurzu
Zpracování mluveného jazyka v Pythonu
Pokyny k cvičení
- Převeď soubory ve složce
pre_purchasedo formátu.wavpomocíconvert_to_wav(). - Převeď soubory ve složce
post_purchasedo formátu.wavpomocíconvert_to_wav().
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Convert post purchase
for file in post_purchase:
print(f"Converting {file} to .wav...")
convert_to_wav(____)
# Convert pre purchase
for file in ____:
print(f"Converting {file} to .wav...")
____(file)