组合连招!
您已经见过最常用的 4 种数据操作:对行排序、选取列、筛选行,以及添加新列。在真实的数据分析中,您可以灵活组合这 4 种操作来回答各种问题。
在本练习中,您将回答这个问题:"哪个州每 10,000 人中无家可归的个人数量最高?"请综合运用您的 pandas 技能找出答案。
本练习是课程的一部分
使用 pandas 进行数据处理
练习说明
- 在
homelessness中添加一列indiv_per_10k,表示每个州每一万人中的无家可归个人数量,使用state_pop表示州人口。 - 筛选
indiv_per_10k大于20的行,赋值给high_homelessness。 - 按
indiv_per_10k降序对high_homelessness排序,赋值给high_homelessness_srt。 - 仅选择
high_homelessness_srt的state和indiv_per_10k两列,保存为result。查看result。
交互式实操练习
通过完成这段示例代码来试试这个练习。
# Create indiv_per_10k col as homeless individuals per 10k state pop
homelessness["indiv_per_10k"] = 10000 * ____ / ____
# Subset rows for indiv_per_10k greater than 20
high_homelessness = ____
# Sort high_homelessness by descending indiv_per_10k
high_homelessness_srt = ____
# From high_homelessness_srt, select the state and indiv_per_10k cols
result = ____
# See the result
print(result)