Mai mulți vorbitori 1
Dacă scopul tău este să transcrii conversații, vei întâlni mai mult de un vorbitor. Totuși, după cum vei vedea, funcția recognize_google() va transcrie vorbirea într-un singur bloc de text.
Poți auzi în acest fișier audio că există trei vorbitori diferiți.
Dacă îl transcrii direct, recognize_google() returnează un singur bloc de text. Rezultatul este în continuare util, însă nu îți indică cine a spus ce.
Vom explora o alternativă la aceasta în exercițiul următor.
Fișierul audio cu mai mulți vorbitori a fost importat și convertit în AudioData sub numele multiple_speakers.
Acest exercițiu face parte din cursul
Procesarea limbajului vorbit în Python
Instrucțiuni pentru exercițiu
- Creează o instanță a clasei
Recognizer. - Recunoaște variabila
multiple_speakersfolosind funcțiarecognize_google(). - Setează limba la engleza americană (
"en-US").
Exercițiu interactiv practic
Încearcă acest exercițiu completând acest cod de exemplu.
# Create a recognizer class
recognizer = sr.____()
# Recognize the multiple speaker AudioData
text = recognizer.recognize_google(____,
language=____)
# Print the text
print(text)