Транскрибування аудіо в один рядок
Гаразд, тепер, коли у вас є функції для перетворення аудіофайлів і визначення їхніх атрибутів, час створити функцію для їхнього транскрибування.
У цій вправі ви створите transcribe_audio(), яка приймає filename як вхід, імпортує filename за допомогою класу AudioFile з speech_recognition, а тоді транскрибує його через recognize_google().
Ви вже бачили ці функції, але тепер поєднаємо їх так, щоб вони були доступні в одній функції.
Щоб перевірити, розпізнаємо перший дзвінок Acme, "call_1.wav".
speech_recognition імпортовано як sr.
Ця вправа є частиною курсу
Обробка усного мовлення в Python
Інструкції до вправи
- Визначте функцію
transcribe_audio, яка приймаєfilenameяк вхідний параметр. - Створіть екземпляр
Recognizer()і збережіть його у зміннійrecognizer. - Використайте
recognize_google()для транскрибування аудіоданих. - Передайте цільовий дзвінок у функцію.
Інтерактивна практична вправа
Спробуйте виконати цю вправу, доповнивши цей зразок коду.
____ ____(____):
"""Takes a .wav format audio file and transcribes it to text."""
# Setup a recognizer instance
____ = sr.Recognizer()
# Import the audio file and convert to audio data
audio_file = sr.AudioFile(filename)
with audio_file as source:
audio_data = recognizer.record(source)
# Return the transcribed text
return recognizer.____(audio_data)
# Test the function
print(transcribe_audio(____))