Înregistrăm segmentul audio de care avem nevoie
Uneori s-ar putea să nu ai nevoie de întregul fișier audio cu care lucrezi. Parametrii duration și offset ai metodei record() te pot ajuta în acest sens.
După ce explorezi setul de date, descoperi că există un fișier, importat ca nothing_at_end, care conține 30 de secunde de liniște la sfârșit, și un fișier cu un apel de suport, importat ca out_of_warranty, care conține 3 secunde de zgomot static la început.
Setând duration și offset, metoda record() va înregistra cel mult duration secunde de audio, începând de la offset. Ambii parametri sunt măsurați în secunde.
Acest exercițiu face parte din cursul
Procesarea limbajului vorbit în Python
Exercițiu interactiv practic
Încearcă acest exercițiu completând acest cod de exemplu.
# Convert AudioFile to AudioData
with nothing_at_end as source:
nothing_at_end_audio = recognizer.record(source,
duration=____,
offset=None)
# Transcribe AudioData to text
text = recognizer.recognize_google(nothing_at_end_audio,
language="en-US")
print(text)