Zacznij terazZacznij za darmo

Transkrypcja audio w jednej linii

Masz już funkcje do konwersji plików audio i pobierania ich atrybutów – czas zbudować funkcję do ich transkrypcji.

W tym ćwiczeniu stworzysz transcribe_audio(), która przyjmuje filename jako wejście, wczytuje plik przy użyciu klasy AudioFile z biblioteki speech_recognition, a następnie transkrybuje go za pomocą recognize_google().

Znasz już te funkcje – teraz połączymy je w całość, tak aby były dostępne w jednej funkcji.

Aby ją przetestować, transkrybujesz pierwsze połączenie Acme: "call_1.wav".

speech_recognition zostało zaimportowane jako sr.

To ćwiczenie jest częścią kursu

Przetwarzanie mowy w Pythonie

Zobacz kurs

Instrukcje do ćwiczenia

  • Zdefiniuj funkcję o nazwie transcribe_audio, która przyjmuje filename jako parametr wejściowy.
  • Utwórz instancję Recognizer() i przypisz ją do zmiennej recognizer.
  • Użyj recognize_google(), aby transkrybować dane audio.
  • Przekaż docelowe połączenie do funkcji.

Interaktywne ćwiczenie praktyczne

Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.

____ ____(____):
  """Takes a .wav format audio file and transcribes it to text."""
  # Setup a recognizer instance
  ____ = sr.Recognizer()
  
  # Import the audio file and convert to audio data
  audio_file = sr.AudioFile(filename)
  with audio_file as source:
    audio_data = recognizer.record(source)
  
  # Return the transcribed text
  return recognizer.____(audio_data)

# Test the function
print(transcribe_audio(____))
Edytuj i uruchom kod