ÎncepețiÎncepe gratuit

Filtrare după companie

Usind același set de date din exercițiul anterior, ai realizat că te interesează doar joburile de nivel de intrare ("EN") din Canada ("CA"). Cum arată salariile acolo? Reține că în spațiul tău de lucru există deja o SparkSession numită spark!

Acest exercițiu face parte din cursul

Introducere în PySpark

Vezi cursul

Instrucțiuni pentru exercițiu

  • Filtrează DataFrame-ul astfel încât company_location să fie "CA".
  • Calculează media coloanei salary_in_usd.
  • Afișează rezultatul!

Exercițiu interactiv practic

Încearcă acest exercițiu completând acest cod de exemplu.

# Average salary for entry level in Canada
CA_jobs = ca_salaries_df.____(ca_salaries_df[____] == "CA").filter(ca_salaries_df['experience_level']
 == "EN").groupBy().____("salary_in_usd")

# Show the result
CA_jobs.____()
Editează și rulează codul