ÎncepețiÎncepe gratuit

De la AudioFile la AudioData

Așa cum ai văzut anterior, există câțiva pași de transformare pe care trebuie să îi parcurgem pentru ca datele audio să fie utilizabile. Același lucru este valabil și pentru SpeechRecognition.

În acest exercițiu, vom importa fișierul audio clean_support_call.wav audio file și îl vom pregăti pentru recunoaștere.

Întâi citim fișierul audio folosind clasa AudioFile. Însă metoda recognize_google() necesită o intrare de tip AudioData.

Pentru a converti AudioFile la AudioData, vom folosi metoda record() a clasei Recognizer împreună cu un context manager. Metoda record() primește un AudioFile ca intrare și îl convertește în AudioData, gata de utilizat cu recognize_google().

SpeechRecognition a fost deja importat ca sr.

Acest exercițiu face parte din cursul

Procesarea limbajului vorbit în Python

Vezi cursul

Instrucțiuni pentru exercițiu

  • Transmite clasei AudioFile fișierul clean_support_call.wav.
  • Folosește context manager-ul pentru a deschide și citi clean_support_call ca source.
  • Înregistrează source și rulează codul.

Exercițiu interactiv practic

Încearcă acest exercițiu completând acest cod de exemplu.

# Instantiate Recognizer
recognizer = sr.Recognizer()

# Convert audio to AudioFile
clean_support_call = sr.AudioFile(____)

# Convert AudioFile to AudioData
with ____ as source:
    clean_support_call_audio = recognizer.record(____)

# Transcribe AudioData to text
text = recognizer.recognize_google(clean_support_call_audio,
                                   language="en-US")
print(text)
Editează și rulează codul