Začněte nyníZačněte zdarma

Nahrávání potřebného zvuku

Někdy možná nebudeš chtít pracovat s celým zvukovým souborem. V takovém případě ti pomohou parametry duration a offset metody record().

Po prozkoumání datasetu zjistíš, že jeden soubor, importovaný jako nothing_at_end, obsahuje 30 sekund ticha na konci a soubor se zákaznickým hovorem, importovaný jako out_of_warranty, má 3 sekundy statického šumu na začátku.

Nastavením duration a offset metoda record() nahraje audio v délce duration začínající od pozice offset. Oba parametry se udávají v sekundách.

Toto cvičení je součástí kurzu

Zpracování mluveného jazyka v Pythonu

Zobrazit kurz

Interaktivní cvičení na vyzkoušení si v praxi

Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.

# Convert AudioFile to AudioData
with nothing_at_end as source:
    nothing_at_end_audio = recognizer.record(source,
                                             duration=____,
                                             offset=None)

# Transcribe AudioData to text
text = recognizer.recognize_google(nothing_at_end_audio,
                                   language="en-US")

print(text)
Upravit a spustit kód