Spela in det ljud vi behöver
Ibland vill du inte använda hela ljudfilen du arbetar med. Parametrarna duration och offset i metoden record() kan hjälpa dig med det.
När du utforskar din datamängd hittar du en fil, importerad som nothing_at_end, som har 30 sekunders tystnad i slutet, och en fil med ett supportsamtal, importerad som out_of_warranty, som har 3 sekunders brus i början.
Genom att ange duration och offset spelar metoden record() in upp till duration sekunder ljud med start vid offset. Båda mäts i sekunder.
Den här övningen är en del av kursen
Taligenkänning i Python
Interaktiv övning med praktiskt arbete
Testa den här övningen genom att slutföra den här exempelkoden.
# Convert AudioFile to AudioData
with nothing_at_end as source:
nothing_at_end_audio = recognizer.record(source,
duration=____,
offset=None)
# Transcribe AudioData to text
text = recognizer.recognize_google(nothing_at_end_audio,
language="en-US")
print(text)