Transkrypcja audio w jednej linii
Masz już funkcje do konwersji plików audio i pobierania ich atrybutów – czas zbudować funkcję do ich transkrypcji.
W tym ćwiczeniu stworzysz transcribe_audio(), która przyjmuje filename jako wejście, wczytuje plik przy użyciu klasy AudioFile z biblioteki speech_recognition, a następnie transkrybuje go za pomocą recognize_google().
Znasz już te funkcje – teraz połączymy je w całość, tak aby były dostępne w jednej funkcji.
Aby ją przetestować, transkrybujesz pierwsze połączenie Acme: "call_1.wav".
speech_recognition zostało zaimportowane jako sr.
To ćwiczenie jest częścią kursu
Przetwarzanie mowy w Pythonie
Instrukcje do ćwiczenia
- Zdefiniuj funkcję o nazwie
transcribe_audio, która przyjmujefilenamejako parametr wejściowy. - Utwórz instancję
Recognizer()i przypisz ją do zmiennejrecognizer. - Użyj
recognize_google(), aby transkrybować dane audio. - Przekaż docelowe połączenie do funkcji.
Interaktywne ćwiczenie praktyczne
Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.
____ ____(____):
"""Takes a .wav format audio file and transcribes it to text."""
# Setup a recognizer instance
____ = sr.Recognizer()
# Import the audio file and convert to audio data
audio_file = sr.AudioFile(filename)
with audio_file as source:
audio_data = recognizer.record(source)
# Return the transcribed text
return recognizer.____(audio_data)
# Test the function
print(transcribe_audio(____))