会社による絞り込み
前の演習と同じデータセットを使って、エントリーレベル("EN")かつカナダ("CA")の求人だけに絞り込んでみましょう。その条件での給与はどのくらいでしょうか?
ワークスペースには、すでに SparkSession として spark が用意されています。
この演習はコースの一部です
PySpark 入門
演習の手順
company_locationが"CA"の行だけになるよう DataFrame をフィルタリングしてください。salary_in_usd列の平均値を計算してください。- 結果を表示してください。
実践的なインタラクティブ演習
このサンプルコードを完成させて、この演習に挑戦してみましょう。
# Average salary for entry level in Canada
CA_jobs = ca_salaries_df.____(ca_salaries_df[____] == "CA").filter(ca_salaries_df['experience_level']
== "EN").groupBy().____("salary_in_usd")
# Show the result
CA_jobs.____()