Comece agoraComece grátis

Um fluxo de processamento de áudio

Você viu como importar e manipular um único arquivo de áudio usando PyDub. Mas e se você tivesse uma pasta com vários arquivos de áudio para converter?

Neste exercício, vamos usar o PyDub para formatar uma pasta de arquivos e deixá-los prontos para usar com speech_recognition.

Você descobriu que os arquivos de ligações dos clientes têm 3 segundos de estática no início e estão mais baixos do que poderiam.

Para corrigir isso, vamos usar o PyDub para cortar a estática, aumentar o nível do som e convertê-los para a extensão .wav.

Você pode ouvir um exemplo sem formatação aqui.

Este exercicio faz parte do curso

Processamento de Linguagem Falada em Python

Ver curso

exercicio interativo prático

Tente este exercicio completando este código de exemplo.

file_with_static = AudioSegment.from_file(____)

# Cut the first 3-seconds of static off
file_without_static = file_with_static[____:]
Editar e Executar Código