or
Ця вправа є частиною курсу
У цьому розділі ми розглянемо, чому слід застосовувати нові техніки, коли набори даних більші за доступну ОЗП. Пояснимо, що імпорт і експорт даних за допомогою базових функцій R можуть бути повільними, і покажемо прості способи це виправити. Нарешті, представимо пакет bigmemory.
Тепер, коли ви вже маєте досвід роботи з bigmemory, розглянемо прості прийоми дослідження та аналізу даних. Зокрема, подивимося, як створювати таблиці та реалізовувати підхід split-apply-combine.
Ми використаємо пакет iotools, який уміє обробляти як числові, так і рядкові дані, та познайомимося з концепцією пакункової (chunk-wise) обробки.
У попередніх розділах ми представили житлові дані та показали, як обчислювати з даними, розмір яких дорівнює або перевищує обсяг ОЗП однієї машини. У цьому розділі проведемо попередній аналіз даних і порівняємо різні тенденції з часом.
Поточна вправа