Flera talare 1
Om målet är att transkribera samtal finns det mer än en talare. Men som du kommer att se returnerar funktionen recognize_google() all tal som ett enda textblock.
I den här ljudfilen hörs tre olika talare.
Om du transkriberar filen som den är returnerar recognize_google() ett enda textblock. Det är fortfarande användbart, men du kan inte se vem som sade vad.
I nästa övning tittar vi på ett alternativt tillvägagångssätt.
Ljudfilen med flera talare har importerats och konverterats till AudioData som multiple_speakers.
Den här övningen är en del av kursen
Taligenkänning i Python
Övningsinstruktioner
- Skapa en instans av
Recognizer. - Transkribera variabeln
multiple_speakersmed funktionenrecognize_google(). - Ange språket till amerikansk engelska (
"en-US").
Interaktiv övning med praktiskt arbete
Testa den här övningen genom att slutföra den här exempelkoden.
# Create a recognizer class
recognizer = sr.____()
# Recognize the multiple speaker AudioData
text = recognizer.recognize_google(____,
language=____)
# Print the text
print(text)