Зчитування сирих даних і перетворення їх на структуру даних
Як уже згадувалося, одна з причин швидкодії iotools полягає в розділенні читання даних із жорсткого диска та їх перетворення з бінарного вигляду на data.frame або matrix. Дані у своєму бінарному форматі копіюються з диска до пам'яті як об'єкти типу raw. Потім ці об'єкти raw передаються оптимізованим функціям, які перетворюють їх на об'єкти data.frame або matrix.
У цій вправі ви навчитеся відокремлювати зчитування даних із диска (за допомогою функції readAsRaw()), а потім перетворювати бінарні дані raw на matrix або data.frame (за допомогою функцій mstrsplit() і dstrsplit()).
Ця вправа є частиною курсу
Масштабована обробка даних в R
Інструкції до вправи
- Зчитайте файл
"mortgage-sample.csv"як вектор типу raw. - Перетворіть вміст вектора raw на
matrixз цілих чисел. - Перетворіть вміст вектора raw на
data.frameіз 16 цілими стовпцями.
Інтерактивна практична вправа
Спробуйте виконати цю вправу, доповнивши цей зразок коду.
# Read mortgage-sample.csv as a raw vector
raw_file_content <- ___("mortgage-sample.csv")
# Convert the raw vector contents to a matrix
mort_mat <- ___(___, sep = ",", type = ___, skip = 1)
# Look at the first 6 rows
head(mort_mat)
# Convert the raw file contents to a data.frame
mort_df <- ___(___, sep = ",", col_types = rep("integer", 16), skip = 1)
# Look at the first 6 rows
head(mort_df)