Kom igångKom igång gratis

Spela in det ljud vi behöver

Ibland vill du inte använda hela ljudfilen du arbetar med. Parametrarna duration och offset i metoden record() kan hjälpa dig med det.

När du utforskar din datamängd hittar du en fil, importerad som nothing_at_end, som har 30 sekunders tystnad i slutet, och en fil med ett supportsamtal, importerad som out_of_warranty, som har 3 sekunders brus i början.

Genom att ange duration och offset spelar metoden record() in upp till duration sekunder ljud med start vid offset. Båda mäts i sekunder.

Den här övningen är en del av kursen

Taligenkänning i Python

Visa kurs

Interaktiv övning med praktiskt arbete

Testa den här övningen genom att slutföra den här exempelkoden.

# Convert AudioFile to AudioData
with nothing_at_end as source:
    nothing_at_end_audio = recognizer.record(source,
                                             duration=____,
                                             offset=None)

# Transcribe AudioData to text
text = recognizer.recognize_google(nothing_at_end_audio,
                                   language="en-US")

print(text)
Redigera och kör kod