Quy trình xử lý âm thanh
Bạn đã thấy cách nhập và thao tác với một tệp âm thanh bằng PyDub. Nhưng nếu bạn có một thư mục chứa nhiều tệp âm thanh cần chuyển đổi thì sao?
Trong bài tập này, chúng ta sẽ dùng PyDub để định dạng một thư mục tệp, sẵn sàng sử dụng với speech_recognition.
Bạn nhận thấy các tệp cuộc gọi của khách hàng đều có 3 giây nhiễu tĩnh ở đầu và âm lượng nhỏ hơn mức nên có.
Để khắc phục, chúng ta sẽ dùng PyDub để cắt phần nhiễu, tăng âm lượng và chuyển chúng sang phần mở rộng .wav.
Bạn có thể nghe một ví dụ chưa được định dạng tại đây.
Bài tập này là một phần của khóa học
Xử lý Ngôn ngữ Nói bằng Python
Bài tập tương tác thực hành trực tiếp
Hãy thử làm bài tập này bằng cách hoàn thành đoạn mã mẫu này.
file_with_static = AudioSegment.from_file(____)
# Cut the first 3-seconds of static off
file_without_static = file_with_static[____:]