開始使用免費開始

從 AudioFile 到 AudioData

如你先前所見,為了讓音訊資料可用,我們需要做一些轉換步驟。對 SpeechRecognition 也是一樣。

在這個練習中,我們會匯入 clean_support_call.wav 音訊檔,並把它準備好以進行辨識。

我們先用 AudioFile 類別讀取音訊檔。但 recognize_google() 方法需要的輸入型別是 AudioData

要把 AudioFile 轉成 AudioData,我們會搭配情境管理器使用 Recognizer 類別的 record() 方法。record() 方法會接受一個 AudioFile 作為輸入並將其轉換為 AudioData,就能與 recognize_google() 一起使用。

SpeechRecognition 已經以 sr 匯入。

本練習屬於課程

Python 的口語語言處理

檢視課程

練習說明

  • clean_support_call.wav 傳入 AudioFile 類別。
  • 使用情境管理器將 clean_support_callsource 開啟並讀取。
  • 錄製 source 並執行程式碼。

動手互動練習

試著完成這個範例程式碼,體驗一下這個練習。

# Instantiate Recognizer
recognizer = sr.Recognizer()

# Convert audio to AudioFile
clean_support_call = sr.AudioFile(____)

# Convert AudioFile to AudioData
with ____ as source:
    clean_support_call_audio = recognizer.record(____)

# Transcribe AudioData to text
text = recognizer.recognize_google(clean_support_call_audio,
                                   language="en-US")
print(text)
編輯並執行程式碼