ÎncepețiÎncepe gratuit

Un flux de procesare audio

Ai văzut cum să imporți și să manipulezi un singur fișier audio folosind PyDub. Dar ce faci dacă ai un folder cu mai multe fișiere audio pe care trebuie să le convertești?

În acest exercițiu vom folosi PyDub pentru a pregăti un folder de fișiere în vederea utilizării cu speech_recognition.

Ai descoperit că toate fișierele cu apeluri ale clienților conțin 3 secunde de zgomot static la început și că volumul lor este mai mic decât ar putea fi.

Pentru a remedia acest lucru, vom folosi PyDub pentru a elimina staticul, a mări nivelul sonor și a le converti la extensia .wav.

Poți asculta un exemplu neformatat aici.

Acest exercițiu face parte din cursul

Procesarea limbajului vorbit în Python

Vezi cursul

Exercițiu interactiv practic

Încearcă acest exercițiu completând acest cod de exemplu.

file_with_static = AudioSegment.from_file(____)

# Cut the first 3-seconds of static off
file_without_static = file_with_static[____:]
Editează și rulează codul