從 AudioFile 到 AudioData
如你先前所見,為了讓音訊資料可用,我們需要做一些轉換步驟。對 SpeechRecognition 也是一樣。
在這個練習中,我們會匯入 clean_support_call.wav 音訊檔,並把它準備好以進行辨識。
我們先用 AudioFile 類別讀取音訊檔。但 recognize_google() 方法需要的輸入型別是 AudioData。
要把 AudioFile 轉成 AudioData,我們會搭配情境管理器使用 Recognizer 類別的 record() 方法。record() 方法會接受一個 AudioFile 作為輸入並將其轉換為 AudioData,就能與 recognize_google() 一起使用。
SpeechRecognition 已經以 sr 匯入。
本練習屬於課程
Python 的口語語言處理
練習說明
- 將
clean_support_call.wav傳入 AudioFile 類別。 - 使用情境管理器將
clean_support_call以source開啟並讀取。 - 錄製
source並執行程式碼。
動手互動練習
試著完成這個範例程式碼,體驗一下這個練習。
# Instantiate Recognizer
recognizer = sr.Recognizer()
# Convert audio to AudioFile
clean_support_call = sr.AudioFile(____)
# Convert AudioFile to AudioData
with ____ as source:
clean_support_call_audio = recognizer.record(____)
# Transcribe AudioData to text
text = recognizer.recognize_google(clean_support_call_audio,
language="en-US")
print(text)