Začněte nyníZačněte zdarma

První vizualizace chybějících dat

Zorientovat se v tom, kde v datech chybějící hodnoty jsou, může být náročné – a právě tady přichází ke slovu vizualizace.

Funkce vis_miss() vytvoří přehlednou vizualizaci chybějících hodnot v datech. Nabízí také možnost shlukovat řádky podle chybějících hodnot pomocí cluster = TRUE a řadit sloupce od těch s nejvíce chybějícími hodnotami po ty s nejméně (sort_miss = TRUE).

Toto cvičení je součástí kurzu

Práce s chybějícími daty v R

Zobrazit kurz

Pokyny k cvičení

Pracuj s datovou sadou riskfactors z balíčku naniar:

  • Pomocí vis_miss() vizualizuj chybějící hodnoty v datech.
  • Použij vis_miss() s parametrem cluster = TRUE a prozkoumej shluky chybějících hodnot.
  • Použij vis_miss() a seřaď chybějící hodnoty pomocí sort_miss, aby se sloupce uspořádaly podle míry chybějících hodnot.

Interaktivní cvičení na vyzkoušení si v praxi

Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.

# Visualize all of the missingness in the `riskfactors`  dataset
vis_miss(___)

# Visualize and cluster all of the missingness in the `riskfactors` dataset
vis_miss(___, ___ = TRUE)

# visualize and sort the columns by missingness in the `riskfactors` dataset
vis_miss(___, ___ = TRUE)
Upravit a spustit kód