Filtrering efter företagets land
Med samma datamängd som i förra övningen insåg du att du bara är intresserad av jobb på ingångsnivå ("EN") i Kanada ("CA"). Hur ser lönerna ut där?
Kom ihåg att det redan finns en SparkSession som heter spark i din miljö!
Den här övningen är en del av kursen
Introduktion till PySpark
Övningsinstruktioner
- Filtrera DataFramen så att du bara behåller rader där
company_locationär"CA". - Beräkna genomsnittet för kolumnen
salary_in_usd. - Visa resultatet!
Interaktiv övning med praktiskt arbete
Testa den här övningen genom att slutföra den här exempelkoden.
# Average salary for entry level in Canada
CA_jobs = ca_salaries_df.____(ca_salaries_df[____] == "CA").filter(ca_salaries_df['experience_level']
== "EN").groupBy().____("salary_in_usd")
# Show the result
CA_jobs.____()