Параметри аудіо в PyDub
Кожен аудіофайл, з яким ви працюєте, має низку характеристик: кількість каналів, частота кадрів (вона ж частота дискретизації), розрядність семпла тощо.
Знання цих параметрів допомагає переконатися, що ваші аудіофайли сумісні з вимогами різних API для розпізнавання мовлення.
Наприклад, багато API рекомендують мінімальну частоту кадрів (wav_file.frame_rate) 16 000 Гц.
Коли ви створюєте екземпляр AudioSegment, PyDub автоматично зчитує ці параметри з вашого аудіофайла і зберігає їх як атрибути.
У цій вправі ми розглянемо ці атрибути.
Ця вправа є частиною курсу
Обробка усного мовлення в Python
Інтерактивна практична вправа
Спробуйте виконати цю вправу, доповнивши цей зразок коду.
# Import audio file
wav_file = AudioSegment.from_file(file="wav_file.wav")
# Find the frame rate
print(wav_file.____)