Dividindo áudio estéreo em mono com PyDub
Se você está tentando transcrever chamadas telefônicas, há uma chance de elas terem sido gravadas em formato estéreo, com um interlocutor em cada canal.
Como você viu, é difícil transcrever um arquivo de áudio com mais de um interlocutor. Uma solução é dividir o arquivo com múltiplos interlocutores em arquivos separados, cada um com um único falante.
A função split_to_mono() do PyDub pode ajudar nisso. Quando chamada em um AudioSegment gravado em estéreo, ela retorna uma lista com dois AudioSegments separados em formato mono, um para cada canal.
Neste exercício, você vai praticar isso dividindo esta gravação de chamada telefônica estéreo (stereo_phone_call.wav) nos canal 1 e canal 2. Isso separa os dois interlocutores, facilitando a transcrição.
Este exercicio faz parte do curso
Processamento de Linguagem Falada em Python
Instruções do exercicio
- Importe
AudioSegmentdepydub. - Crie uma instância
AudioSegmentstereo_phone_callcomstereo_phone_call.wav. - Divida
stereo_phone_callemchannelsusandosplit_to_mono()e verifique os canais do resultado. - Salve cada canal em novas variáveis,
phone_call_channel_1ephone_call_channel_2.
exercicio interativo prático
Tente este exercicio completando este código de exemplo.
# Import AudioSegment
from ____ import ____
# Import stereo audio file and check channels
stereo_phone_call = AudioSegment.from_file(____)
print(f"Stereo number channels: {stereo_phone_call.channels}")
# Split stereo phone call and check channels
channels = stereo_phone_call.____
print(f"Split number channels: {channels[0].____}, {channels[1].____}")
# Save new channels separately
phone_call_channel_1 = channels[0]
phone_call_channel_2 = ____