Primele tale vizualizări ale datelor lipsă
Poate fi dificil să înțelegi unde se află valorile lipsă în datele tale – și tocmai aici vizualizarea te poate ajuta cu adevărat.
Funcția vis_miss() creează o vizualizare de ansamblu a valorilor lipsă din date. Aceasta oferă și opțiuni pentru gruparea rândurilor în funcție de valorile lipsă, folosind cluster = TRUE, precum și pentru sortarea coloanelor de la cele cu cele mai multe valori lipsă la cele cu cele mai puține (sort_miss = TRUE).
Acest exercițiu face parte din cursul
Gestionarea datelor lipsă în R
Instrucțiuni pentru exercițiu
Folosind setul de date riskfactors din naniar:
- Folosește
vis_miss()pentru a vizualiza valorile lipsă din date. - Folosește
vis_miss()cucluster = TRUEpentru a explora grupurile de valori lipsă. - Folosește
vis_miss()și sortează valorile lipsă cusort_misspentru a aranja coloanele în funcție de numărul de valori lipsă.
Exercițiu interactiv practic
Încearcă acest exercițiu completând acest cod de exemplu.
# Visualize all of the missingness in the `riskfactors` dataset
vis_miss(___)
# Visualize and cluster all of the missingness in the `riskfactors` dataset
vis_miss(___, ___ = TRUE)
# visualize and sort the columns by missingness in the `riskfactors` dataset
vis_miss(___, ___ = TRUE)