ПочатиПочніть безкоштовно

Кілька мовців 1

Якщо ваша мета — транскрибувати розмови, зазвичай є більше ніж один мовець. Однак, як ви побачите, функція recognize_google() транскрибує мовлення лише в один суцільний блок тексту.

У цьому аудіофайлі чутно трьох різних мовців.

Але якщо транскрибувати його напряму, recognize_google() повертає один суцільний блок тексту. Це корисно, але не дає зрозуміти, хто саме що сказав.

Альтернативний підхід ми розглянемо в наступній вправі.

Аудіофайл із кількома мовцями імпортовано й перетворено на AudioData як multiple_speakers.

Ця вправа є частиною курсу

Обробка усного мовлення в Python

Переглянути курс

Інструкції до вправи

  • Створіть екземпляр Recognizer.
  • Розпізнайте змінну multiple_speakers за допомогою функції recognize_google().
  • Установіть мову як американську англійську ("en-US").

Інтерактивна практична вправа

Спробуйте виконати цю вправу, доповнивши цей зразок коду.

# Create a recognizer class
recognizer = sr.____()

# Recognize the multiple speaker AudioData
text = recognizer.recognize_google(____, 
                       			   language=____)

# Print the text
print(text)
Редагувати та запускати код