Začněte nyníZačněte zdarma

Přepis zvuku na jeden řádek

Máš za sebou funkce pro převod zvukových souborů a zjišťování jejich vlastností – teď je čas sestavit funkci pro jejich přepis.

V tomto cvičení vytvoříš funkci transcribe_audio(), která jako vstup přijme filename, načte soubor pomocí třídy AudioFile z knihovny speech_recognition a přepíše ho pomocí recognize_google().

S těmito funkcemi ses už setkal/a – teď je jen spojíme dohromady, aby byly dostupné v rámci jedné funkce.

Na vyzkoušení přepíšeme první hovor Acme, "call_1.wav".

speech_recognition je importován jako sr.

Toto cvičení je součástí kurzu

Zpracování mluveného jazyka v Pythonu

Zobrazit kurz

Pokyny k cvičení

  • Definuj funkci transcribe_audio, která přijímá filename jako vstupní parametr.
  • Vytvoř instanci Recognizer() a ulož ji jako recognizer.
  • Pomocí recognize_google() proveď přepis zvukových dat.
  • Předej cílový hovor do funkce.

Interaktivní cvičení na vyzkoušení si v praxi

Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.

____ ____(____):
  """Takes a .wav format audio file and transcribes it to text."""
  # Setup a recognizer instance
  ____ = sr.Recognizer()
  
  # Import the audio file and convert to audio data
  audio_file = sr.AudioFile(filename)
  with audio_file as source:
    audio_data = recognizer.record(source)
  
  # Return the transcribed text
  return recognizer.____(audio_data)

# Test the function
print(transcribe_audio(____))
Upravit a spustit kód