PyDub の統計情報を確認する
任意のファイルについて音声の属性を手早く把握できると便利だと考えました。特に、音声ファイルのチャンネル数や、文字起こしに十分なフレームレートかどうかを確認するのに役立ちます。
この演習では、音声ファイルのファイル名を受け取る show_pydub_stats() を作成します。関数は音声を PyDub の AudioSegment インスタンスとして読み込み、チャンネル数、長さなどの属性を表示します。
その後、後で使えるように AudioSegment インスタンスを返します。
作成した関数を、新しく変換した .wav ファイル である call_1.wav に対して使ってみます。
AudioSegment はすでに PyDub からインポート済みです。
この演習はコースの一部です
Pythonで学ぶ音声言語処理
演習の手順
filename引数からインポートして、audio_segmentという名前のAudioSegmentインスタンスを作成します。channels属性を使ってチャンネル数を出力します。audio_segment変数を返します。"call_1.wav"で関数をテストします。
実践的なインタラクティブ演習
このサンプルコードを完成させて、この演習に挑戦してみましょう。
def show_pydub_stats(filename):
"""Returns different audio attributes related to an audio file."""
# Create AudioSegment instance
____ = AudioSegment.from_file(____)
# Print audio attributes and return AudioSegment instance
print(f"Channels: {audio_segment.____}")
print(f"Sample width: {audio_segment.sample_width}")
print(f"Frame rate (sample rate): {audio_segment.frame_rate}")
print(f"Frame width: {audio_segment.frame_width}")
print(f"Length (ms): {len(audio_segment)}")
return ____
# Try the function
call_1_audio_segment = ____(____)