Comece agoraComece grátis

Vários falantes 1

Se o seu objetivo é transcrever conversas, haverá mais de um falante. Porém, como você verá, a função recognize_google() só transcreve a fala em um único bloco de texto.

Você pode ouvir neste arquivo de áudio que há três falantes diferentes.

Mas, se você transcrevê-lo isoladamente, recognize_google() retorna um único bloco de texto. Ainda é útil, mas não informa qual falante disse o quê.

Veremos uma alternativa para isso no próximo exercício.

O arquivo de áudio com vários falantes foi importado e convertido para AudioData como multiple_speakers.

Este exercicio faz parte do curso

Processamento de Linguagem Falada em Python

Ver curso

Instruções do exercicio

  • Crie uma instância de Recognizer.
  • Reconheça a variável multiple_speakers usando a função recognize_google().
  • Defina o idioma como inglês dos EUA ("en-US").

exercicio interativo prático

Tente este exercicio completando este código de exemplo.

# Create a recognizer class
recognizer = sr.____()

# Recognize the multiple speaker AudioData
text = recognizer.recognize_google(____, 
                       			   language=____)

# Print the text
print(text)
Editar e Executar Código