開始使用免費開始

偵測遺漏值

資料集常會把遺漏值以隱藏的替代符號表示,例如 'NA'、'.' 或其他字元。本練習要使用 college 資料集,其中包含大學生的各種資訊。你的任務是透過分析資料集來辨識遺漏值。

你可以搭配使用 pandas.info() 方法、numpysort() 函式,以及 .unique() 方法,來清楚分辨用來代表遺漏資料的虛擬值。

college.csv 檔案已為你載入。numpypandas 也已分別以 nppd 匯入。

本練習屬於課程

在 Python 中處理遺漏值

檢視課程

動手互動練習

試著完成這個範例程式碼,體驗一下這個練習。

# Read the dataset 'college.csv'
college = ___
print(college.head())
編輯並執行程式碼