ПочатиПочніть безкоштовно

Параметри аудіо в PyDub

Кожен аудіофайл, з яким ви працюєте, має низку характеристик: кількість каналів, частота кадрів (вона ж частота дискретизації), розрядність семпла тощо.

Знання цих параметрів допомагає переконатися, що ваші аудіофайли сумісні з вимогами різних API для розпізнавання мовлення.

Наприклад, багато API рекомендують мінімальну частоту кадрів (wav_file.frame_rate) 16 000 Гц.

Коли ви створюєте екземпляр AudioSegment, PyDub автоматично зчитує ці параметри з вашого аудіофайла і зберігає їх як атрибути.

У цій вправі ми розглянемо ці атрибути.

Ця вправа є частиною курсу

Обробка усного мовлення в Python

Переглянути курс

Інтерактивна практична вправа

Спробуйте виконати цю вправу, доповнивши цей зразок коду.

# Import audio file
wav_file = AudioSegment.from_file(file="wav_file.wav")

# Find the frame rate
print(wav_file.____)
Редагувати та запускати код