Bäst och sämst anpassade modeller
I den här övningen ska du besvara följande frågor:
- Hur väl anpassar sig dina modeller till dina data överlag?
- Vilka är de bäst anpassade modellerna?
- Vilka modeller passar inte datan särskilt bra?
Den här övningen är en del av kursen
Maskininlärning med Tidyverse
Övningsinstruktioner
- Plotta ett histogram över \(R^2\)-värdena för de 77 modellerna
- Extrahera de 4 bäst anpassade modellerna (baserat på \(R^2\)) och spara denna dataram som
best_fit - Extrahera de 4 sämst anpassade modellerna (baserat på \(R^2\)) och spara denna dataram som
worst_fit
Interaktiv övning med praktiskt arbete
Testa den här övningen genom att slutföra den här exempelkoden.
# Plot a histogram of rsquared for the 77 models
model_perf %>%
ggplot(aes(x = ___)) +
___()
# Extract the 4 best fitting models
best_fit <- model_perf %>%
slice_max(___, n = ___)
# Extract the 4 models with the worst fit
worst_fit <- model_perf %>%
slice_min(___, n = ___)