Nagrywanie potrzebnego fragmentu audio
Czasem nie potrzebujesz całego pliku audio, z którym pracujesz. Parametry duration i offset metody record() mogą ci w tym pomóc.
Po przejrzeniu zbioru danych odkrywasz, że jeden plik – zaimportowany jako nothing_at_end – zawiera 30 sekund ciszy na końcu, a plik z rozmową serwisową, zaimportowany jako out_of_warranty, ma 3 sekundy szumu na początku.
Ustawienie parametrów duration i offset sprawia, że metoda record() nagrywa fragment audio o długości duration sekund, zaczynając od momentu offset. Oba parametry podaje się w sekundach.
To ćwiczenie jest częścią kursu
Przetwarzanie mowy w Pythonie
Interaktywne ćwiczenie praktyczne
Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.
# Convert AudioFile to AudioData
with nothing_at_end as source:
nothing_at_end_audio = recognizer.record(source,
duration=____,
offset=None)
# Transcribe AudioData to text
text = recognizer.recognize_google(nothing_at_end_audio,
language="en-US")
print(text)