První vizualizace chybějících dat
Zorientovat se v tom, kde v datech chybějící hodnoty jsou, může být náročné – a právě tady přichází ke slovu vizualizace.
Funkce vis_miss() vytvoří přehlednou vizualizaci chybějících hodnot v datech. Nabízí také možnost shlukovat řádky podle chybějících hodnot pomocí cluster = TRUE a řadit sloupce od těch s nejvíce chybějícími hodnotami po ty s nejméně (sort_miss = TRUE).
Toto cvičení je součástí kurzu
Práce s chybějícími daty v R
Pokyny k cvičení
Pracuj s datovou sadou riskfactors z balíčku naniar:
- Pomocí
vis_miss()vizualizuj chybějící hodnoty v datech. - Použij
vis_miss()s parametremcluster = TRUEa prozkoumej shluky chybějících hodnot. - Použij
vis_miss()a seřaď chybějící hodnoty pomocísort_miss, aby se sloupce uspořádaly podle míry chybějících hodnot.
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Visualize all of the missingness in the `riskfactors` dataset
vis_miss(___)
# Visualize and cluster all of the missingness in the `riskfactors` dataset
vis_miss(___, ___ = TRUE)
# visualize and sort the columns by missingness in the `riskfactors` dataset
vis_miss(___, ___ = TRUE)