連招出擊!
你已經看過 4 種最常見的資料處理方式:排序列、子集化欄位、子集化列,以及新增欄位。在真實的資料分析中,你可以靈活組合這四種操作,來回答各式各樣的問題。
在這個練習中,你要回答:「哪一個州每 10,000 人中無家者的人數最高?」把你剛學到的 pandas 技巧組合起來找出答案。
本練習屬於課程
使用 pandas 進行資料操作
練習說明
- 在
homelessness中新增欄位indiv_per_10k,其值為各州每一萬人中的無家者人數,並使用state_pop作為州人口數。 - 將
indiv_per_10k高於20的列子集化,指定為high_homelessness。 - 以
indiv_per_10k遞減排序high_homelessness,指定為high_homelessness_srt。 - 只選取
high_homelessness_srt的state與indiv_per_10k欄位並儲存為result。請查看result。
動手互動練習
試著完成這個範例程式碼,體驗一下這個練習。
# Create indiv_per_10k col as homeless individuals per 10k state pop
homelessness["indiv_per_10k"] = 10000 * ____ / ____
# Subset rows for indiv_per_10k greater than 20
high_homelessness = ____
# Sort high_homelessness by descending indiv_per_10k
high_homelessness_srt = ____
# From high_homelessness_srt, select the state and indiv_per_10k cols
result = ____
# See the result
print(result)