Comece agoraComece grátis

Dividindo áudio estéreo em mono com PyDub

Se você está tentando transcrever chamadas telefônicas, há uma chance de elas terem sido gravadas em formato estéreo, com um interlocutor em cada canal.

Como você viu, é difícil transcrever um arquivo de áudio com mais de um interlocutor. Uma solução é dividir o arquivo com múltiplos interlocutores em arquivos separados, cada um com um único falante.

A função split_to_mono() do PyDub pode ajudar nisso. Quando chamada em um AudioSegment gravado em estéreo, ela retorna uma lista com dois AudioSegments separados em formato mono, um para cada canal.

Neste exercício, você vai praticar isso dividindo esta gravação de chamada telefônica estéreo (stereo_phone_call.wav) nos canal 1 e canal 2. Isso separa os dois interlocutores, facilitando a transcrição.

Este exercicio faz parte do curso

Processamento de Linguagem Falada em Python

Ver curso

Instruções do exercicio

  • Importe AudioSegment de pydub.
  • Crie uma instância AudioSegment stereo_phone_call com stereo_phone_call.wav.
  • Divida stereo_phone_call em channels usando split_to_mono() e verifique os canais do resultado.
  • Salve cada canal em novas variáveis, phone_call_channel_1 e phone_call_channel_2.

exercicio interativo prático

Tente este exercicio completando este código de exemplo.

# Import AudioSegment
from ____ import ____

# Import stereo audio file and check channels
stereo_phone_call = AudioSegment.from_file(____)
print(f"Stereo number channels: {stereo_phone_call.channels}")

# Split stereo phone call and check channels
channels = stereo_phone_call.____
print(f"Split number channels: {channels[0].____}, {channels[1].____}")

# Save new channels separately
phone_call_channel_1 = channels[0]
phone_call_channel_2 = ____
Editar e Executar Código