Kom igångKom igång gratis

Filtrering efter företagets land

Med samma datamängd som i förra övningen insåg du att du bara är intresserad av jobb på ingångsnivå ("EN") i Kanada ("CA"). Hur ser lönerna ut där? Kom ihåg att det redan finns en SparkSession som heter spark i din miljö!

Den här övningen är en del av kursen

Introduktion till PySpark

Visa kurs

Övningsinstruktioner

  • Filtrera DataFramen så att du bara behåller rader där company_location är "CA".
  • Beräkna genomsnittet för kolumnen salary_in_usd.
  • Visa resultatet!

Interaktiv övning med praktiskt arbete

Testa den här övningen genom att slutföra den här exempelkoden.

# Average salary for entry level in Canada
CA_jobs = ca_salaries_df.____(ca_salaries_df[____] == "CA").filter(ca_salaries_df['experience_level']
 == "EN").groupBy().____("salary_in_usd")

# Show the result
CA_jobs.____()
Redigera och kör kod