Nahrávání potřebného zvuku
Někdy možná nebudeš chtít pracovat s celým zvukovým souborem. V takovém případě ti pomohou parametry duration a offset metody record().
Po prozkoumání datasetu zjistíš, že jeden soubor, importovaný jako nothing_at_end, obsahuje 30 sekund ticha na konci a soubor se zákaznickým hovorem, importovaný jako out_of_warranty, má 3 sekundy statického šumu na začátku.
Nastavením duration a offset metoda record() nahraje audio v délce duration začínající od pozice offset. Oba parametry se udávají v sekundách.
Toto cvičení je součástí kurzu
Zpracování mluveného jazyka v Pythonu
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Convert AudioFile to AudioData
with nothing_at_end as source:
nothing_at_end_audio = recognizer.record(source,
duration=____,
offset=None)
# Transcribe AudioData to text
text = recognizer.recognize_google(nothing_at_end_audio,
language="en-US")
print(text)