最良・最悪の当てはまりのモデル
この演習では次の質問に答えます。
- 全体として、モデルはデータにどの程度よく当てはまっていますか?
- 最も当てはまりが良いモデルはどれですか?
- データにうまく当てはまらないモデルはどれですか?
この演習はコースの一部です
Tidyverse で学ぶ Machine Learning
演習の手順
- 77 個のモデルの \(R^2\) のヒストグラムを作成します
- \(R^2\) に基づいて当てはまりが最も良い 4 つのモデルを抽出し、このデータフレームを
best_fitとして保存します - \(R^2\) に基づいて当てはまりが最も悪い 4 つのモデルを抽出し、このデータフレームを
worst_fitとして保存します
実践的なインタラクティブ演習
このサンプルコードを完成させて、この演習に挑戦してみましょう。
# Plot a histogram of rsquared for the 77 models
model_perf %>%
ggplot(aes(x = ___)) +
___()
# Extract the 4 best fitting models
best_fit <- model_perf %>%
slice_max(___, n = ___)
# Extract the 4 models with the worst fit
worst_fit <- model_perf %>%
slice_min(___, n = ___)