按公司筛选
继续使用上个练习中的同一数据集。您发现自己只关心加拿大 ("CA") 的入门级 ("EN") 职位。在那里薪资是什么水平?
请记住,您的工作区中已经有一个 SparkSession,名为 spark!
本练习是课程的一部分
PySpark 入门
练习说明
- 使用筛选将 DataFrame 子集限定为
company_location为"CA"。 - 计算
salary_in_usd列的平均值。 - 显示结果!
交互式实操练习
通过完成这段示例代码来试试这个练习。
# Average salary for entry level in Canada
CA_jobs = ca_salaries_df.____(ca_salaries_df[____] == "CA").filter(ca_salaries_df['experience_level']
== "EN").groupBy().____("salary_in_usd")
# Show the result
CA_jobs.____()