Normalizarea unui fișier audio cu PyDub
Uneori vei întâlni fișiere audio în care vorbirea este tare în anumite porțiuni și slabă în altele. Această variație a volumului poate îngreuna transcrierea.
Din fericire, modulul de efecte al PyDub include o funcție numită normalize(), care identifică volumul maxim al unui AudioSegment, apoi ajustează restul fișierului proporțional. Astfel, porțiunile mai liniștite vor primi un impuls de volum.
Poți asculta un exemplu de fișier audio care începe tare și devine liniștit, loud_then_quiet.wav, aici.
În acest exercițiu, vei folosi normalize() pentru a uniformiza volumul fișierului nostru, astfel încât să sune mai degrabă ca în acest exemplu.
Acest exercițiu face parte din cursul
Procesarea limbajului vorbit în Python
Instrucțiuni pentru exercițiu
- Importă
AudioSegmentdinPyDubșinormalizedin modulul de efecte alPyDub. - Importă fișierul audio țintă,
loud_then_quiet.wav, și salvează-l în variabilaloud_then_quiet. - Normalizează fișierul audio importat folosind funcția
normalize()și salvează rezultatul înnormalized_loud_then_quiet.
Exercițiu interactiv practic
Încearcă acest exercițiu completând acest cod de exemplu.
# Import AudioSegment and normalize
from pydub import ____
from pydub.effects import ____
# Import target audio file
loud_then_quiet = AudioSegment.from_file(____)
# Normalize target audio file
normalized_loud_then_quiet = ____(____)