偵測遺漏值
資料集常會把遺漏值以隱藏的替代符號表示,例如 'NA'、'.' 或其他字元。本練習要使用 college 資料集,其中包含大學生的各種資訊。你的任務是透過分析資料集來辨識遺漏值。
你可以搭配使用 pandas 的 .info() 方法、numpy 的 sort() 函式,以及 .unique() 方法,來清楚分辨用來代表遺漏資料的虛擬值。
college.csv 檔案已為你載入。numpy 與 pandas 也已分別以 np 與 pd 匯入。
本練習屬於課程
在 Python 中處理遺漏值
動手互動練習
試著完成這個範例程式碼,體驗一下這個練習。
# Read the dataset 'college.csv'
college = ___
print(college.head())