ランダムフォレストで特徴量重要度を計算する
あなたは金融コンサルティング企業のデータサイエンティストとして、個人を所得レベルで分類するランダムフォレスト分類器を開発しました。次は、特徴量重要度を分析してモデルを説明し、所得予測の主要因を特定する必要があります。これにより、より的確な市場セグメンテーションと戦略的な意思決定の改善につながります。
matplotlib.pyplot は plt としてインポート済みです。X_train と y_train はあらかじめ読み込まれています。
この演習はコースの一部です
Pythonで学ぶExplainable AI
演習の手順
modelから特徴量重要度を抽出します。feature_importancesを可視化します。
実践的なインタラクティブ演習
このサンプルコードを完成させて、この演習に挑戦してみましょう。
model = RandomForestClassifier(random_state=42)
model.fit(X_train, y_train)
# Derive feature importances
feature_importances = ____
# Plot the feature importances
____
plt.show()