Kom igångKom igång gratis

Ett arbetsflöde för ljudbearbetning

Du har sett hur man importerar och manipulerar en enskild ljudfil med PyDub. Men vad händer om du har en mapp med flera ljudfiler som behöver konverteras?

I den här övningen använder vi PyDub för att formatera en mapp med filer så att de är redo att användas med speech_recognition.

Du har märkt att dina kundtjänstsamtal har 3 sekunder av brus i början och att volymen är lägre än önskvärt.

För att åtgärda detta använder vi PyDub för att klippa bort bruset, höja volymen och konvertera filerna till formatet .wav.

Du kan lyssna på ett oformaterat exempel här.

Den här övningen är en del av kursen

Taligenkänning i Python

Visa kurs

Interaktiv övning med praktiskt arbete

Testa den här övningen genom att slutföra den här exempelkoden.

file_with_static = AudioSegment.from_file(____)

# Cut the first 3-seconds of static off
file_without_static = file_with_static[____:]
Redigera och kör kod