Чтение фрагментов данных в виде матрицы
В этом упражнении вы напишете масштабируемую функцию table(), которая подсчитывает количество городских и сельских заёмщиков в наборе данных по ипотеке с помощью chunk.apply(). По умолчанию chunk.apply() агрегирует обработанные данные с помощью функции rbind(). Это означает, что вы можете создать таблицу из каждого фрагмента, а затем сложить строки полученной матрицы, чтобы получить итоговые счётчики.
Мы создали файловое соединение fc с файлом "mortgage-sample.csv" и считали первую строку, чтобы пропустить заголовок.
Это упражнение является частью курса
Масштабируемая обработка данных в R
Интерактивное практическое упражнение
Попробуйте выполнить это упражнение, дополнив этот пример кода.
# Define the function to apply to each chunk
make_table <- function(chunk) {
# Read each chunk as a matrix
x <- ___(chunk, type = "integer", sep = ",")
# Create a table of the number of borrowers (column 3) for each chunk
table(x[, 3])
}