Przycinanie i łączenie plików audio
Niektóre pliki audio mogą zawierać zbędne fragmenty. Na przykład na początku każdego pliku może znajdować się kilka sekund szumu statycznego.
Zamiast marnować moc obliczeniową na próbę transkrypcji szumu, możesz go po prostu usunąć.
Ponieważ obiekt AudioSegment jest iterowalny i mierzony w milisekundach, możesz użyć wycinania (slicing) do zmiany jego długości.
Aby pobrać pierwsze 3 sekundy z wav_file, użyj wav_file[:3000].
Dwa obiekty AudioSegment można też łączyć za pomocą operatora dodawania. To przydatna technika, gdy chcesz scalić kilka plików audio.
Aby przećwiczyć obie te operacje, usuniemy pierwsze cztery sekundy pliku part1.wav i połączymy pozostałą część z plikiem part2.wav. Wynik powinien brzmieć jak part_3.wav.
To ćwiczenie jest częścią kursu
Przetwarzanie mowy w Pythonie
Instrukcje do ćwiczenia
- Wczytaj pliki
part_1.wavipart_2.wavi zapisz je odpowiednio do zmiennychpart_1ipart_2. - Usuń pierwsze 4 sekundy z
part_1za pomocą wycinania i zapisz wynik do zmiennejpart_1_removed. - Dodaj
part_1_removeddopart_2i zapisz wynik do zmiennejpart_3.
Interaktywne ćwiczenie praktyczne
Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.
from pydub import AudioSegment
# Import part 1 and part 2 audio files
part_1 = AudioSegment.from_file(____)
part_2 = ____.____(____)
# Remove the first four seconds of part 1
part_1_removed = part_1[____:]
# Add the remainder of part 1 and part 2 together
part_3 = ____ + ____