Ett arbetsflöde för ljudbearbetning
Du har sett hur man importerar och manipulerar en enskild ljudfil med PyDub. Men vad händer om du har en mapp med flera ljudfiler som behöver konverteras?
I den här övningen använder vi PyDub för att formatera en mapp med filer så att de är redo att användas med speech_recognition.
Du har märkt att dina kundtjänstsamtal har 3 sekunder av brus i början och att volymen är lägre än önskvärt.
För att åtgärda detta använder vi PyDub för att klippa bort bruset, höja volymen och konvertera filerna till formatet .wav.
Du kan lyssna på ett oformaterat exempel här.
Den här övningen är en del av kursen
Taligenkänning i Python
Interaktiv övning med praktiskt arbete
Testa den här övningen genom att slutföra den här exempelkoden.
file_with_static = AudioSegment.from_file(____)
# Cut the first 3-seconds of static off
file_without_static = file_with_static[____:]