始める無料で始める

欠損値を検出する

データセットには、欠損値を表す隠れたダミー値(例:'NA'、'.' など)が含まれていることがよくあります。この演習では、大学生のさまざまな情報を含む college データセットを扱います。あなたのタスクは、データセットを分析して欠損値を特定することです。

これを行うには、pandas.info() メソッドや、.unique() メソッドと組み合わせた numpysort() 関数を使い、欠損データを表すダミー値をはっきり区別します。

college.csv はすでに読み込まれています。numpypandas もそれぞれ nppd としてインポート済みです。

この演習はコースの一部です

Pythonで欠損データに対処する

コースを見る

実践的なインタラクティブ演習

このサンプルコードを完成させて、この演習に挑戦してみましょう。

# Read the dataset 'college.csv'
college = ___
print(college.head())
コードを編集して実行