Vários falantes 1
Se o seu objetivo é transcrever conversas, haverá mais de um falante. Porém, como você verá, a função recognize_google() só transcreve a fala em um único bloco de texto.
Você pode ouvir neste arquivo de áudio que há três falantes diferentes.
Mas, se você transcrevê-lo isoladamente, recognize_google() retorna um único bloco de texto. Ainda é útil, mas não informa qual falante disse o quê.
Veremos uma alternativa para isso no próximo exercício.
O arquivo de áudio com vários falantes foi importado e convertido para AudioData como multiple_speakers.
Este exercicio faz parte do curso
Processamento de Linguagem Falada em Python
Instruções do exercicio
- Crie uma instância de
Recognizer. - Reconheça a variável
multiple_speakersusando a funçãorecognize_google(). - Defina o idioma como inglês dos EUA (
"en-US").
exercicio interativo prático
Tente este exercicio completando este código de exemplo.
# Create a recognizer class
recognizer = sr.____()
# Recognize the multiple speaker AudioData
text = recognizer.recognize_google(____,
language=____)
# Print the text
print(text)