欠損値を検出する
データセットには、欠損値を表す隠れたダミー値(例:'NA'、'.' など)が含まれていることがよくあります。この演習では、大学生のさまざまな情報を含む college データセットを扱います。あなたのタスクは、データセットを分析して欠損値を特定することです。
これを行うには、pandas の .info() メソッドや、.unique() メソッドと組み合わせた numpy の sort() 関数を使い、欠損データを表すダミー値をはっきり区別します。
college.csv はすでに読み込まれています。numpy と pandas もそれぞれ np と pd としてインポート済みです。
この演習はコースの一部です
Pythonで欠損データに対処する
実践的なインタラクティブ演習
このサンプルコードを完成させて、この演習に挑戦してみましょう。
# Read the dataset 'college.csv'
college = ___
print(college.head())