Inizia subitoInizia gratis

Un flusso di lavoro per l'elaborazione audio

Hai visto come importare e manipolare un singolo file audio usando PyDub. Ma se avessi una cartella con più file audio da convertire?

In questo esercizio useremo PyDub per formattare una cartella di file in modo che siano pronti per l'uso con speech_recognition.

Hai scoperto che i tuoi file delle chiamate dei clienti hanno 3 secondi di fruscio all'inizio e sono più silenziosi di quanto potrebbero essere.

Per risolvere, useremo PyDub per tagliare il fruscio iniziale, aumentare il livello del suono e convertirli all'estensione .wav.

Puoi ascoltare un esempio non formattato qui.

Questo esercizio fa parte del corso

Elaborazione del linguaggio parlato in Python

Visualizza corso

esercizio interattivo pratico

Prova questo esercizio completando questo codice di esempio.

file_with_static = AudioSegment.from_file(____)

# Cut the first 3-seconds of static off
file_without_static = file_with_static[____:]
Modifica ed esegui il codice