or
Bu egzersiz, kursun bir parçasıdır
Bu bölümde, veri kümeleri mevcut RAM'den büyük olduğunda neden yeni teknikler uygulaman gerektiğini ele alıyoruz. Taban R fonksiyonlarıyla veri içe ve dışa aktarmanın yavaş olabileceğini ve bunu kolayca iyileştirmenin bazı yollarını gösteriyoruz. Son olarak, bigmemory paketini tanıtıyoruz.
Artık bigmemory kullanma konusunda biraz deneyim kazandığına göre, bazı basit veri keşfi ve analiz tekniklerini ele alacağız. Özellikle, nasıl tablo oluşturulacağını ve split-apply-combine yaklaşımının nasıl uygulanacağını göreceğiz.
Hem sayısal hem de karakter verilerini işleyebilen iotools paketini kullanacağız ve parça bazlı (chunk-wise) işlemenin kavramını tanıtacağız.
Önceki bölümlerde, konut verilerini tanıttık ve tek bir makinedeki RAM kadar büyük ya da daha büyük verilerle nasıl hesaplama yapılacağını gösterdik. Bu bölümde, zaman içindeki çeşitli eğilimleri karşılaştırarak verilerin ön analizini yapacağız.
Geçerli egzersiz