НачатьНачать бесплатно

Транскрибирование аудио в одну строку

Итак, у вас уже есть функции для преобразования аудиофайлов и получения их характеристик — теперь пришло время создать функцию для их транскрибирования.

В этом упражнении вы напишете функцию transcribe_audio(), которая принимает filename в качестве входного параметра, загружает файл с помощью класса AudioFile из библиотеки speech_recognition, а затем транскрибирует его с помощью recognize_google().

Вы уже встречали эти функции раньше — теперь мы объединим их, чтобы сделать удобными для использования в одной функции.

Для проверки мы транскрибируем первый звонок компании Acme, "call_1.wav".

Библиотека speech_recognition уже импортирована как sr.

Это упражнение является частью курса

Обработка устной речи на Python

Посмотреть курс

Инструкции к упражнению

  • Определите функцию transcribe_audio, которая принимает filename в качестве входного параметра.
  • Создайте экземпляр Recognizer() и сохраните его в переменную recognizer.
  • Используйте recognize_google() для транскрибирования аудиоданных.
  • Передайте целевой звонок в созданную функцию.

Интерактивное практическое упражнение

Попробуйте выполнить это упражнение, дополнив этот пример кода.

____ ____(____):
  """Takes a .wav format audio file and transcribes it to text."""
  # Setup a recognizer instance
  ____ = sr.Recognizer()
  
  # Import the audio file and convert to audio data
  audio_file = sr.AudioFile(filename)
  with audio_file as source:
    audio_data = recognizer.record(source)
  
  # Return the transcribed text
  return recognizer.____(audio_data)

# Test the function
print(transcribe_audio(____))
Редактировать и запускать код