Normalizzare un file audio con PyDub
A volte capita di avere file audio in cui la voce è alta in alcune parti e bassa in altre. Questa variazione di volume può ostacolare la trascrizione.
Per fortuna, il modulo effects di PyDub ha una funzione chiamata normalize() che individua il volume massimo di un AudioSegment, quindi regola il resto dell'AudioSegment in proporzione. Questo significa che le parti più basse verranno amplificate.
Puoi ascoltare un esempio di file audio che inizia forte e poi diventa più silenzioso, loud_then_quiet.wav, qui.
In questo esercizio userai normalize() per uniformare il volume del file, facendolo suonare più simile a questo.
Questo esercizio fa parte del corso
Elaborazione del linguaggio parlato in Python
Istruzioni dell'esercizio
- Importa
AudioSegmentdaPyDubenormalizedal modulo effects diPyDub. - Importa il file audio di destinazione,
loud_then_quiet.wav, e salvalo inloud_then_quiet. - Normalizza il file audio importato usando la funzione
normalize()e salvalo innormalized_loud_then_quiet.
esercizio interattivo pratico
Prova questo esercizio completando questo codice di esempio.
# Import AudioSegment and normalize
from pydub import ____
from pydub.effects import ____
# Import target audio file
loud_then_quiet = AudioSegment.from_file(____)
# Normalize target audio file
normalized_loud_then_quiet = ____(____)