Przepływ pracy przy przetwarzaniu dźwięku
Wiesz już, jak importować i modyfikować pojedynczy plik audio za pomocą PyDub. Co jednak, jeśli masz folder z wieloma plikami audio do przekonwertowania?
W tym ćwiczeniu użyjemy PyDub, aby przygotować folder plików do użycia z biblioteką speech_recognition.
Okazuje się, że wszystkie pliki z rozmowami klientów mają 3 sekundy szumu na początku i są cichsze, niż powinny być.
Aby to naprawić, użyjemy PyDub do wycięcia szumu, zwiększenia głośności i konwersji plików do formatu .wav.
Przykład niesformatowanego pliku możesz odsłuchać tutaj.
To ćwiczenie jest częścią kursu
Przetwarzanie mowy w Pythonie
Interaktywne ćwiczenie praktyczne
Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.
file_with_static = AudioSegment.from_file(____)
# Cut the first 3-seconds of static off
file_without_static = file_with_static[____:]