PyDubで音声パラメータを確認する
扱う音声ファイルには、チャンネル数、フレームレート(サンプルレート)、サンプル幅など、さまざまな特徴があります。
これらのパラメータを把握しておくと、音声認識のAPI要件に音声ファイルが適合しているかを確認できます。
たとえば、多くのAPIは最小フレームレート(wav_file.frame_rate)として16,000 Hzを推奨しています。
AudioSegment のインスタンスを作成すると、PyDub は音声ファイルから自動的にこれらのパラメータを推定し、属性として保持します。
この演習では、これらの属性を確認していきます。
この演習はコースの一部です
Pythonで学ぶ音声言語処理
実践的なインタラクティブ演習
このサンプルコードを完成させて、この演習に挑戦してみましょう。
# Import audio file
wav_file = AudioSegment.from_file(file="wav_file.wav")
# Find the frame rate
print(wav_file.____)