Обрезка и изменение аудиофайлов
В некоторых аудиофайлах могут быть лишние фрагменты. Например, в начале каждого файла может быть несколько секунд статического шума.
Чтобы не тратить вычислительные ресурсы на транскрибирование шума, его можно удалить.
Поскольку AudioSegment является итерируемым объектом и измеряется в миллисекундах, для изменения длины можно использовать срезы.
Чтобы получить первые 3 секунды wav_file, используйте wav_file[:3000].
Два объекта AudioSegment также можно объединить с помощью оператора сложения — это удобно, когда нужно склеить несколько аудиофайлов.
Для отработки обоих приёмов мы удалим первые четыре секунды из part1.wav и добавим оставшуюся часть к part2.wav. В результате должен получиться файл, звучащий как part_3.wav.
Это упражнение является частью курса
Обработка устной речи на Python
Инструкции к упражнению
- Импортируйте
part_1.wavиpart_2.wavи сохраните их в переменныеpart_1иpart_2соответственно. - Удалите первые 4 секунды из
part_1с помощью среза и сохраните результат вpart_1_removed. - Добавьте
part_1_removedкpart_2и сохраните результат вpart_3.
Интерактивное практическое упражнение
Попробуйте выполнить это упражнение, дополнив этот пример кода.
from pydub import AudioSegment
# Import part 1 and part 2 audio files
part_1 = AudioSegment.from_file(____)
part_2 = ____.____(____)
# Remove the first four seconds of part 1
part_1_removed = part_1[____:]
# Add the remainder of part 1 and part 2 together
part_3 = ____ + ____