Кілька мовців 1
Якщо ваша мета — транскрибувати розмови, зазвичай є більше ніж один мовець. Однак, як ви побачите, функція recognize_google() транскрибує мовлення лише в один суцільний блок тексту.
У цьому аудіофайлі чутно трьох різних мовців.
Але якщо транскрибувати його напряму, recognize_google() повертає один суцільний блок тексту. Це корисно, але не дає зрозуміти, хто саме що сказав.
Альтернативний підхід ми розглянемо в наступній вправі.
Аудіофайл із кількома мовцями імпортовано й перетворено на AudioData як multiple_speakers.
Ця вправа є частиною курсу
Обробка усного мовлення в Python
Інструкції до вправи
- Створіть екземпляр
Recognizer. - Розпізнайте змінну
multiple_speakersза допомогою функціїrecognize_google(). - Установіть мову як американську англійську (
"en-US").
Інтерактивна практична вправа
Спробуйте виконати цю вправу, доповнивши цей зразок коду.
# Create a recognizer class
recognizer = sr.____()
# Recognize the multiple speaker AudioData
text = recognizer.recognize_google(____,
language=____)
# Print the text
print(text)