Enregistrer seulement l'audio nécessaire
Parfois, vous ne voulez pas nécessairement tout le fichier audio avec lequel vous travaillez. Les paramètres duration et offset de la méthode record() peuvent vous aider.
Après avoir exploré votre jeu de données, vous constatez qu'il y a un fichier, importé sous le nom nothing_at_end, qui comporte 30 secondes de silence à la fin, et un fichier d'appel au soutien, importé sous le nom out_of_warranty, qui a 3 secondes de parasites au début.
Définir duration et offset signifie que la méthode record() enregistrera jusqu'à duration d'audio en commençant à offset. Les deux sont mesurés en secondes.
Cette activité fait partie du cours
Traitement de la langue parlée en Python
Exercice interactif pratique
Essayez cet exercice en complétant ce code d’exemple.
# Convert AudioFile to AudioData
with nothing_at_end as source:
nothing_at_end_audio = recognizer.record(source,
duration=____,
offset=None)
# Transcribe AudioData to text
text = recognizer.recognize_google(nothing_at_end_audio,
language="en-US")
print(text)