НачатьНачать бесплатно

Записываем нужный фрагмент аудио

Иногда вам может понадобиться не весь аудиофайл целиком. В таких случаях помогут параметры duration и offset метода record().

Изучив набор данных, вы обнаружили, что в файле, импортированном как nothing_at_end, последние 30 секунд — тишина, а в файле с записью звонка в службу поддержки, импортированном как out_of_warranty, первые 3 секунды — статический шум.

Параметр duration задаёт длительность записываемого фрагмента, а offset — отступ от начала файла. Оба параметра измеряются в секундах.

Это упражнение является частью курса

Обработка устной речи на Python

Посмотреть курс

Интерактивное практическое упражнение

Попробуйте выполнить это упражнение, дополнив этот пример кода.

# Convert AudioFile to AudioData
with nothing_at_end as source:
    nothing_at_end_audio = recognizer.record(source,
                                             duration=____,
                                             offset=None)

# Transcribe AudioData to text
text = recognizer.recognize_google(nothing_at_end_audio,
                                   language="en-US")

print(text)
Редактировать и запускать код