Bắt đầu ngayBắt đầu miễn phí

Quy trình xử lý âm thanh

Bạn đã thấy cách nhập và thao tác với một tệp âm thanh bằng PyDub. Nhưng nếu bạn có một thư mục chứa nhiều tệp âm thanh cần chuyển đổi thì sao?

Trong bài tập này, chúng ta sẽ dùng PyDub để định dạng một thư mục tệp, sẵn sàng sử dụng với speech_recognition.

Bạn nhận thấy các tệp cuộc gọi của khách hàng đều có 3 giây nhiễu tĩnh ở đầu và âm lượng nhỏ hơn mức nên có.

Để khắc phục, chúng ta sẽ dùng PyDub để cắt phần nhiễu, tăng âm lượng và chuyển chúng sang phần mở rộng .wav.

Bạn có thể nghe một ví dụ chưa được định dạng tại đây.

Bài tập này là một phần của khóa học

Xử lý Ngôn ngữ Nói bằng Python

Xem khóa học

Bài tập tương tác thực hành trực tiếp

Hãy thử làm bài tập này bằng cách hoàn thành đoạn mã mẫu này.

file_with_static = AudioSegment.from_file(____)

# Cut the first 3-seconds of static off
file_without_static = file_with_static[____:]
Chỉnh sửa và Chạy Mã