始める無料で始める

AudioFile から AudioData へ

前に見たとおり、オーディオデータを活用するにはいくつかの前処理が必要です。SpeechRecognition でも同様です。

この演習では、clean_support_call.wav音声ファイルを読み込み、認識に向けて準備します。

最初に AudioFile クラスで音声ファイルを読み込みます。ただし、recognize_google() メソッドは AudioData 型の入力を必要とします。

AudioFileAudioData に変換するために、Recognizer クラスの record() メソッドとコンテキストマネージャを使います。record()AudioFile を入力に取り、recognize_google() で使える AudioData に変換します。

SpeechRecognition はすでに sr としてインポートされています。

この演習はコースの一部です

Pythonで学ぶ音声言語処理

コースを見る

演習の手順

  • AudioFile クラスに clean_support_call.wav を渡してください。
  • コンテキストマネージャを使って、clean_support_callsource として開いて読み込みます。
  • source を録音して、コードを実行します。

実践的なインタラクティブ演習

このサンプルコードを完成させて、この演習に挑戦してみましょう。

# Instantiate Recognizer
recognizer = sr.Recognizer()

# Convert audio to AudioFile
clean_support_call = sr.AudioFile(____)

# Convert AudioFile to AudioData
with ____ as source:
    clean_support_call_audio = recognizer.record(____)

# Transcribe AudioData to text
text = recognizer.recognize_google(clean_support_call_audio,
                                   language="en-US")
print(text)
コードを編集して実行