시작하기무료로 시작하기

AudioFile에서 AudioData로

앞에서 보았듯이, 오디오 데이터를 유용하게 쓰려면 몇 가지 변환 단계가 필요해요. SpeechRecognition도 마찬가지입니다.

이 연습에서는 clean_support_call.wav 오디오 파일을 가져와서 음성 인식이 가능하도록 준비해 보겠습니다.

먼저 AudioFile 클래스를 사용해 오디오 파일을 읽습니다. 하지만 recognize_google() 메서드는 AudioData 타입의 입력을 필요로 합니다.

AudioFileAudioData로 변환하려면 Recognizer 클래스의 record() 메서드를 컨텍스트 매니저와 함께 사용하면 됩니다. record() 메서드는 AudioFile을 입력으로 받아 recognize_google()에서 바로 쓸 수 있는 AudioData로 변환합니다.

SpeechRecognition은 이미 sr로 임포트되어 있습니다.

이 연습은 강의의 일부입니다

Python으로 배우는 음성 언어 처리

강의 보기

연습 안내

  • AudioFile 클래스에 clean_support_call.wav를 전달하세요.
  • 컨텍스트 매니저를 사용해 clean_support_callsource로 열고 읽으세요.
  • source를 기록(record)하고 코드를 실행하세요.

실습형 인터랙티브 연습

이 예제를 이 샘플 코드를 완성하여 풀어보세요.

# Instantiate Recognizer
recognizer = sr.Recognizer()

# Convert audio to AudioFile
clean_support_call = sr.AudioFile(____)

# Convert AudioFile to AudioData
with ____ as source:
    clean_support_call_audio = recognizer.record(____)

# Transcribe AudioData to text
text = recognizer.recognize_google(clean_support_call_audio,
                                   language="en-US")
print(text)
코드 편집 및 실행