Přepis zvuku na jeden řádek
Máš za sebou funkce pro převod zvukových souborů a zjišťování jejich vlastností – teď je čas sestavit funkci pro jejich přepis.
V tomto cvičení vytvoříš funkci transcribe_audio(), která jako vstup přijme filename, načte soubor pomocí třídy AudioFile z knihovny speech_recognition a přepíše ho pomocí recognize_google().
S těmito funkcemi ses už setkal/a – teď je jen spojíme dohromady, aby byly dostupné v rámci jedné funkce.
Na vyzkoušení přepíšeme první hovor Acme, "call_1.wav".
speech_recognition je importován jako sr.
Toto cvičení je součástí kurzu
Zpracování mluveného jazyka v Pythonu
Pokyny k cvičení
- Definuj funkci
transcribe_audio, která přijímáfilenamejako vstupní parametr. - Vytvoř instanci
Recognizer()a ulož ji jakorecognizer. - Pomocí
recognize_google()proveď přepis zvukových dat. - Předej cílový hovor do funkce.
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
____ ____(____):
"""Takes a .wav format audio file and transcribes it to text."""
# Setup a recognizer instance
____ = sr.Recognizer()
# Import the audio file and convert to audio data
audio_file = sr.AudioFile(filename)
with audio_file as source:
audio_data = recognizer.record(source)
# Return the transcribed text
return recognizer.____(audio_data)
# Test the function
print(transcribe_audio(____))