Wielu mówców 1
Jeśli chcesz transkrybować rozmowy, będzie w nich więcej niż jeden mówca. Jak zaraz zobaczysz, funkcja recognize_google() transkrybuje całą mowę jako jeden blok tekstu.
W tym pliku audio można usłyszeć trzech różnych mówców.
Jeśli jednak przeprowadzisz transkrypcję samodzielnie, recognize_google() zwróci jeden blok tekstu. To wciąż przydatne, ale nie wskazuje, który mówca powiedział co.
Alternatywne podejście poznasz w następnym ćwiczeniu.
Plik audio z wieloma mówcami został zaimportowany i przekonwertowany do formatu AudioData jako multiple_speakers.
To ćwiczenie jest częścią kursu
Przetwarzanie mowy w Pythonie
Instrukcje do ćwiczenia
- Utwórz instancję klasy
Recognizer. - Rozpoznaj mowę z zmiennej
multiple_speakersza pomocą funkcjirecognize_google(). - Ustaw język na angielski (USA) (
"en-US").
Interaktywne ćwiczenie praktyczne
Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.
# Create a recognizer class
recognizer = sr.____()
# Recognize the multiple speaker AudioData
text = recognizer.recognize_google(____,
language=____)
# Print the text
print(text)