НачатьНачать бесплатно

Параметры аудио с PyDub

Каждый аудиофайл имеет ряд характеристик: количество каналов, частота кадров (или частота дискретизации), ширина сэмпла и другие.

Знание этих параметров помогает убедиться, что ваши аудиофайлы совместимы с требованиями различных API для распознавания речи.

Например, многие API рекомендуют минимальную частоту кадров (wav_file.frame_rate) не менее 16 000 Гц.

При создании экземпляра AudioSegment библиотека PyDub автоматически определяет эти параметры из аудиофайла и сохраняет их в виде атрибутов.

В этом упражнении мы изучим данные атрибуты.

Это упражнение является частью курса

Обработка устной речи на Python

Посмотреть курс

Интерактивное практическое упражнение

Попробуйте выполнить это упражнение, дополнив этот пример кода.

# Import audio file
wav_file = AudioSegment.from_file(file="wav_file.wav")

# Find the frame rate
print(wav_file.____)
Редактировать и запускать код