ÎncepețiÎncepe gratuit

Normalizarea unui fișier audio cu PyDub

Uneori vei întâlni fișiere audio în care vorbirea este tare în anumite porțiuni și slabă în altele. Această variație a volumului poate îngreuna transcrierea.

Din fericire, modulul de efecte al PyDub include o funcție numită normalize(), care identifică volumul maxim al unui AudioSegment, apoi ajustează restul fișierului proporțional. Astfel, porțiunile mai liniștite vor primi un impuls de volum.

Poți asculta un exemplu de fișier audio care începe tare și devine liniștit, loud_then_quiet.wav, aici.

În acest exercițiu, vei folosi normalize() pentru a uniformiza volumul fișierului nostru, astfel încât să sune mai degrabă ca în acest exemplu.

Acest exercițiu face parte din cursul

Procesarea limbajului vorbit în Python

Vezi cursul

Instrucțiuni pentru exercițiu

  • Importă AudioSegment din PyDub și normalize din modulul de efecte al PyDub.
  • Importă fișierul audio țintă, loud_then_quiet.wav, și salvează-l în variabila loud_then_quiet.
  • Normalizează fișierul audio importat folosind funcția normalize() și salvează rezultatul în normalized_loud_then_quiet.

Exercițiu interactiv practic

Încearcă acest exercițiu completând acest cod de exemplu.

# Import AudioSegment and normalize
from pydub import ____
from pydub.effects import ____

# Import target audio file
loud_then_quiet = AudioSegment.from_file(____)

# Normalize target audio file
normalized_loud_then_quiet = ____(____)
Editează și rulează codul