ÎncepețiÎncepe gratuit

Primele tale vizualizări ale datelor lipsă

Poate fi dificil să înțelegi unde se află valorile lipsă în datele tale – și tocmai aici vizualizarea te poate ajuta cu adevărat.

Funcția vis_miss() creează o vizualizare de ansamblu a valorilor lipsă din date. Aceasta oferă și opțiuni pentru gruparea rândurilor în funcție de valorile lipsă, folosind cluster = TRUE, precum și pentru sortarea coloanelor de la cele cu cele mai multe valori lipsă la cele cu cele mai puține (sort_miss = TRUE).

Acest exercițiu face parte din cursul

Gestionarea datelor lipsă în R

Vezi cursul

Instrucțiuni pentru exercițiu

Folosind setul de date riskfactors din naniar:

  • Folosește vis_miss() pentru a vizualiza valorile lipsă din date.
  • Folosește vis_miss() cu cluster = TRUE pentru a explora grupurile de valori lipsă.
  • Folosește vis_miss() și sortează valorile lipsă cu sort_miss pentru a aranja coloanele în funcție de numărul de valori lipsă.

Exercițiu interactiv practic

Încearcă acest exercițiu completând acest cod de exemplu.

# Visualize all of the missingness in the `riskfactors`  dataset
vis_miss(___)

# Visualize and cluster all of the missingness in the `riskfactors` dataset
vis_miss(___, ___ = TRUE)

# visualize and sort the columns by missingness in the `riskfactors` dataset
vis_miss(___, ___ = TRUE)
Editează și rulează codul