ПочатиПочніть безкоштовно

Транскрибування аудіо в один рядок

Гаразд, тепер, коли у вас є функції для перетворення аудіофайлів і визначення їхніх атрибутів, час створити функцію для їхнього транскрибування.

У цій вправі ви створите transcribe_audio(), яка приймає filename як вхід, імпортує filename за допомогою класу AudioFile з speech_recognition, а тоді транскрибує його через recognize_google().

Ви вже бачили ці функції, але тепер поєднаємо їх так, щоб вони були доступні в одній функції.

Щоб перевірити, розпізнаємо перший дзвінок Acme, "call_1.wav".

speech_recognition імпортовано як sr.

Ця вправа є частиною курсу

Обробка усного мовлення в Python

Переглянути курс

Інструкції до вправи

  • Визначте функцію transcribe_audio, яка приймає filename як вхідний параметр.
  • Створіть екземпляр Recognizer() і збережіть його у змінній recognizer.
  • Використайте recognize_google() для транскрибування аудіоданих.
  • Передайте цільовий дзвінок у функцію.

Інтерактивна практична вправа

Спробуйте виконати цю вправу, доповнивши цей зразок коду.

____ ____(____):
  """Takes a .wav format audio file and transcribes it to text."""
  # Setup a recognizer instance
  ____ = sr.Recognizer()
  
  # Import the audio file and convert to audio data
  audio_file = sr.AudioFile(filename)
  with audio_file as source:
    audio_data = recognizer.record(source)
  
  # Return the transcribed text
  return recognizer.____(audio_data)

# Test the function
print(transcribe_audio(____))
Редагувати та запускати код