Записываем нужный фрагмент аудио
Иногда вам может понадобиться не весь аудиофайл целиком. В таких случаях помогут параметры duration и offset метода record().
Изучив набор данных, вы обнаружили, что в файле, импортированном как nothing_at_end, последние 30 секунд — тишина, а в файле с записью звонка в службу поддержки, импортированном как out_of_warranty, первые 3 секунды — статический шум.
Параметр duration задаёт длительность записываемого фрагмента, а offset — отступ от начала файла. Оба параметра измеряются в секундах.
Это упражнение является частью курса
Обработка устной речи на Python
Интерактивное практическое упражнение
Попробуйте выполнить это упражнение, дополнив этот пример кода.
# Convert AudioFile to AudioData
with nothing_at_end as source:
nothing_at_end_audio = recognizer.record(source,
duration=____,
offset=None)
# Transcribe AudioData to text
text = recognizer.recognize_google(nothing_at_end_audio,
language="en-US")
print(text)