Zacznij terazZacznij za darmo

Nagrywanie potrzebnego fragmentu audio

Czasem nie potrzebujesz całego pliku audio, z którym pracujesz. Parametry duration i offset metody record() mogą ci w tym pomóc.

Po przejrzeniu zbioru danych odkrywasz, że jeden plik – zaimportowany jako nothing_at_end – zawiera 30 sekund ciszy na końcu, a plik z rozmową serwisową, zaimportowany jako out_of_warranty, ma 3 sekundy szumu na początku.

Ustawienie parametrów duration i offset sprawia, że metoda record() nagrywa fragment audio o długości duration sekund, zaczynając od momentu offset. Oba parametry podaje się w sekundach.

To ćwiczenie jest częścią kursu

Przetwarzanie mowy w Pythonie

Zobacz kurs

Interaktywne ćwiczenie praktyczne

Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.

# Convert AudioFile to AudioData
with nothing_at_end as source:
    nothing_at_end_audio = recognizer.record(source,
                                             duration=____,
                                             offset=None)

# Transcribe AudioData to text
text = recognizer.recognize_google(nothing_at_end_audio,
                                   language="en-US")

print(text)
Edytuj i uruchom kod