Nejlépe a nejhůře fitting modely
V tomto cvičení si odpovíš na následující otázky:
- Jak dobře celkově tvoje modely odpovídají datům?
- Které modely mají nejlepší fit?
- Které modely datům příliš nesedí?
Toto cvičení je součástí kurzu
Machine Learning in the Tidyverse
Pokyny k cvičení
- Vykresli histogram hodnot \(R^2\) pro všech 77 modelů
- Extrahuj 4 nejlépe fitting modely (podle \(R^2\)) a ulož tento datový rámec jako
best_fit - Extrahuj 4 nejhůře fitting modely (podle \(R^2\)) a ulož tento datový rámec jako
worst_fit
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Plot a histogram of rsquared for the 77 models
model_perf %>%
ggplot(aes(x = ___)) +
___()
# Extract the 4 best fitting models
best_fit <- model_perf %>%
slice_max(___, n = ___)
# Extract the 4 models with the worst fit
worst_fit <- model_perf %>%
slice_min(___, n = ___)