Транскрибирование аудио в одну строку
Итак, у вас уже есть функции для преобразования аудиофайлов и получения их характеристик — теперь пришло время создать функцию для их транскрибирования.
В этом упражнении вы напишете функцию transcribe_audio(), которая принимает filename в качестве входного параметра, загружает файл с помощью класса AudioFile из библиотеки speech_recognition, а затем транскрибирует его с помощью recognize_google().
Вы уже встречали эти функции раньше — теперь мы объединим их, чтобы сделать удобными для использования в одной функции.
Для проверки мы транскрибируем первый звонок компании Acme, "call_1.wav".
Библиотека speech_recognition уже импортирована как sr.
Это упражнение является частью курса
Обработка устной речи на Python
Инструкции к упражнению
- Определите функцию
transcribe_audio, которая принимаетfilenameв качестве входного параметра. - Создайте экземпляр
Recognizer()и сохраните его в переменнуюrecognizer. - Используйте
recognize_google()для транскрибирования аудиоданных. - Передайте целевой звонок в созданную функцию.
Интерактивное практическое упражнение
Попробуйте выполнить это упражнение, дополнив этот пример кода.
____ ____(____):
"""Takes a .wav format audio file and transcribes it to text."""
# Setup a recognizer instance
____ = sr.Recognizer()
# Import the audio file and convert to audio data
audio_file = sr.AudioFile(filename)
with audio_file as source:
audio_data = recognizer.record(source)
# Return the transcribed text
return recognizer.____(audio_data)
# Test the function
print(transcribe_audio(____))