pandas関数を効果的に使う
ユーザーが選択した変数に基づいて要約統計量を計算するPythonアプリケーションを作成しています。完全なデータセットはかなり大きいです。今は、adult として事前読み込みされたデータの一部を使ってコードを準備しています。再利用可能な処理を作るにあたり、GroupBy オブジェクトを最も効率的に設定する方法を意識してください。
この演習はコースの一部です
Pythonでカテゴリカルデータを扱う
演習の手順
- ユーザーが選択した2つの変数名
"Education"と"Above/Below 50k"のリストを作成します。 - グループ化の変数として
user_listを使い、GroupByオブジェクトgbを作成します。 - 動画で扱った最も効率的な方法を使って、各グループにおける
"Hours/Week"の平均を計算します。
実践的なインタラクティブ演習
このサンプルコードを完成させて、この演習に挑戦してみましょう。
# Create a list of user-selected variables
user_list = ____
# Create a GroupBy object using this list
gb = ____
# Find the mean for the variable "Hours/Week" for each group - Be efficient!
print(____)