İlk eksik veri görselleştirmen
Verindeki eksik değerlerin nerede olduğunu kavramak zor olabilir; işte tam burada görselleştirme çok yardımcı olur.
vis_miss() fonksiyonu, verideki eksikliklerin genel bir görselleştirmesini oluşturur. Ayrıca, cluster = TRUE ile eksiklik durumuna göre satırları kümeleme seçeneğine; en çok eksikten en aza doğru sütunları sıralamak için de (sort_miss = TRUE) seçeneğine sahiptir.
Bu egzersiz, kursun bir parçasıdır
R'de Eksik Verilerle Başa Çıkma
Egzersiz talimatları
naniar paketindeki riskfactors veri kümesini kullanarak:
- Verideki eksiklikleri görselleştirmek için
vis_miss()kullan. - Eksiklik kümelerini keşfetmek için
vis_miss()ilecluster = TRUEkullan. - Sütunları eksiklik miktarına göre düzenlemek için
vis_miss()kullan ve eksiklerisort_missile sırala.
Uygulamalı etkileşimli egzersiz
Bu egzersizi bu örnek kodu tamamlayarak deneyin.
# Visualize all of the missingness in the `riskfactors` dataset
vis_miss(___)
# Visualize and cluster all of the missingness in the `riskfactors` dataset
vis_miss(___, ___ = TRUE)
# visualize and sort the columns by missingness in the `riskfactors` dataset
vis_miss(___, ___ = TRUE)