Bắt đầu ngayBắt đầu miễn phí

Đọc từng khối dữ liệu dưới dạng ma trận

Trong bài này, bạn sẽ viết một hàm table() có khả năng mở rộng để đếm số người vay ở khu vực đô thị và nông thôn trong bộ dữ liệu mortgage bằng chunk.apply(). Mặc định, chunk.apply() gộp dữ liệu đã xử lý bằng hàm rbind(). Điều này có nghĩa là bạn có thể tạo bảng từ từng khối dữ liệu, rồi cộng các hàng của ma trận kết quả để có tổng số cho bảng.

Chúng tôi đã tạo một kết nối tệp fc tới tệp "mortgage-sample.csv" và đọc dòng đầu tiên để bỏ phần tiêu đề.

Bài tập này là một phần của khóa học

Xử lý dữ liệu có khả năng mở rộng trong R

Xem khóa học

Bài tập tương tác thực hành trực tiếp

Hãy thử làm bài tập này bằng cách hoàn thành đoạn mã mẫu này.

# Define the function to apply to each chunk
make_table <- function(chunk) {
    # Read each chunk as a matrix
    x <- ___(chunk, type = "integer", sep = ",")
    # Create a table of the number of borrowers (column 3) for each chunk
    table(x[, 3])
}
Chỉnh sửa và Chạy Mã