AudioFile から AudioData へ
前に見たとおり、オーディオデータを活用するにはいくつかの前処理が必要です。SpeechRecognition でも同様です。
この演習では、clean_support_call.wav の音声ファイルを読み込み、認識に向けて準備します。
最初に AudioFile クラスで音声ファイルを読み込みます。ただし、recognize_google() メソッドは AudioData 型の入力を必要とします。
AudioFile を AudioData に変換するために、Recognizer クラスの record() メソッドとコンテキストマネージャを使います。record() は AudioFile を入力に取り、recognize_google() で使える AudioData に変換します。
SpeechRecognition はすでに sr としてインポートされています。
この演習はコースの一部です
Pythonで学ぶ音声言語処理
演習の手順
- AudioFile クラスに
clean_support_call.wavを渡してください。 - コンテキストマネージャを使って、
clean_support_callをsourceとして開いて読み込みます。 sourceを録音して、コードを実行します。
実践的なインタラクティブ演習
このサンプルコードを完成させて、この演習に挑戦してみましょう。
# Instantiate Recognizer
recognizer = sr.Recognizer()
# Convert audio to AudioFile
clean_support_call = sr.AudioFile(____)
# Convert AudioFile to AudioData
with ____ as source:
clean_support_call_audio = recognizer.record(____)
# Transcribe AudioData to text
text = recognizer.recognize_google(clean_support_call_audio,
language="en-US")
print(text)