ÎncepețiÎncepe gratuit

Mai mulți vorbitori 1

Dacă scopul tău este să transcrii conversații, vei întâlni mai mult de un vorbitor. Totuși, după cum vei vedea, funcția recognize_google() va transcrie vorbirea într-un singur bloc de text.

Poți auzi în acest fișier audio că există trei vorbitori diferiți.

Dacă îl transcrii direct, recognize_google() returnează un singur bloc de text. Rezultatul este în continuare util, însă nu îți indică cine a spus ce.

Vom explora o alternativă la aceasta în exercițiul următor.

Fișierul audio cu mai mulți vorbitori a fost importat și convertit în AudioData sub numele multiple_speakers.

Acest exercițiu face parte din cursul

Procesarea limbajului vorbit în Python

Vezi cursul

Instrucțiuni pentru exercițiu

  • Creează o instanță a clasei Recognizer.
  • Recunoaște variabila multiple_speakers folosind funcția recognize_google().
  • Setează limba la engleza americană ("en-US").

Exercițiu interactiv practic

Încearcă acest exercițiu completând acest cod de exemplu.

# Create a recognizer class
recognizer = sr.____()

# Recognize the multiple speaker AudioData
text = recognizer.recognize_google(____, 
                       			   language=____)

# Print the text
print(text)
Editează și rulează codul