開始使用免費開始

連招出擊!

你已經看過 4 種最常見的資料處理方式:排序列、子集化欄位、子集化列,以及新增欄位。在真實的資料分析中,你可以靈活組合這四種操作,來回答各式各樣的問題。

在這個練習中,你要回答:「哪一個州每 10,000 人中無家者的人數最高?」把你剛學到的 pandas 技巧組合起來找出答案。

本練習屬於課程

使用 pandas 進行資料操作

檢視課程

練習說明

  • homelessness 中新增欄位 indiv_per_10k,其值為各州每一萬人中的無家者人數,並使用 state_pop 作為州人口數。
  • indiv_per_10k 高於 20 的列子集化,指定為 high_homelessness
  • indiv_per_10k 遞減排序 high_homelessness,指定為 high_homelessness_srt
  • 只選取 high_homelessness_srtstateindiv_per_10k 欄位並儲存為 result。請查看 result

動手互動練習

試著完成這個範例程式碼,體驗一下這個練習。

# Create indiv_per_10k col as homeless individuals per 10k state pop
homelessness["indiv_per_10k"] = 10000 * ____ / ____ 

# Subset rows for indiv_per_10k greater than 20
high_homelessness = ____

# Sort high_homelessness by descending indiv_per_10k
high_homelessness_srt = ____

# From high_homelessness_srt, select the state and indiv_per_10k cols
result = ____

# See the result
print(result)
編輯並執行程式碼