ÎncepețiÎncepe gratuit

Transcrierea audio într-o singură linie

Acum că ai funcții pentru a converti fișiere audio și pentru a le afla atributele, a venit momentul să construiești una care să le transcrie.

În acest exercițiu, vei crea funcția transcribe_audio(), care primește un filename ca intrare, îl importă folosind clasa AudioFile din speech_recognition și îl transcrie cu recognize_google().

Ai mai văzut aceste funcții, dar acum le vom combina pentru a le face accesibile dintr-o singură funcție.

Pentru a o testa, vom transcrie primul apel Acme, "call_1.wav".

speech_recognition a fost importat ca sr.

Acest exercițiu face parte din cursul

Procesarea limbajului vorbit în Python

Vezi cursul

Instrucțiuni pentru exercițiu

  • Definește o funcție numită transcribe_audio care primește filename ca parametru de intrare.
  • Creează o instanță Recognizer() pe care s-o numești recognizer.
  • Folosește recognize_google() pentru a transcrie datele audio.
  • Transmite apelul țintă către funcție.

Exercițiu interactiv practic

Încearcă acest exercițiu completând acest cod de exemplu.

____ ____(____):
  """Takes a .wav format audio file and transcribes it to text."""
  # Setup a recognizer instance
  ____ = sr.Recognizer()
  
  # Import the audio file and convert to audio data
  audio_file = sr.AudioFile(filename)
  with audio_file as source:
    audio_data = recognizer.record(source)
  
  # Return the transcribed text
  return recognizer.____(audio_data)

# Test the function
print(transcribe_audio(____))
Editează și rulează codul