Zacznij terazZacznij za darmo

Przepływ pracy przy przetwarzaniu dźwięku

Wiesz już, jak importować i modyfikować pojedynczy plik audio za pomocą PyDub. Co jednak, jeśli masz folder z wieloma plikami audio do przekonwertowania?

W tym ćwiczeniu użyjemy PyDub, aby przygotować folder plików do użycia z biblioteką speech_recognition.

Okazuje się, że wszystkie pliki z rozmowami klientów mają 3 sekundy szumu na początku i są cichsze, niż powinny być.

Aby to naprawić, użyjemy PyDub do wycięcia szumu, zwiększenia głośności i konwersji plików do formatu .wav.

Przykład niesformatowanego pliku możesz odsłuchać tutaj.

To ćwiczenie jest częścią kursu

Przetwarzanie mowy w Pythonie

Zobacz kurs

Interaktywne ćwiczenie praktyczne

Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.

file_with_static = AudioSegment.from_file(____)

# Cut the first 3-seconds of static off
file_without_static = file_with_static[____:]
Edytuj i uruchom kod