Filtrare după companie
Usind același set de date din exercițiul anterior, ai realizat că te interesează doar joburile de nivel de intrare ("EN") din Canada ("CA"). Cum arată salariile acolo?
Reține că în spațiul tău de lucru există deja o SparkSession numită spark!
Acest exercițiu face parte din cursul
Introducere în PySpark
Instrucțiuni pentru exercițiu
- Filtrează DataFrame-ul astfel încât
company_locationsă fie"CA". - Calculează media coloanei
salary_in_usd. - Afișează rezultatul!
Exercițiu interactiv practic
Încearcă acest exercițiu completând acest cod de exemplu.
# Average salary for entry level in Canada
CA_jobs = ca_salaries_df.____(ca_salaries_df[____] == "CA").filter(ca_salaries_df['experience_level']
== "EN").groupBy().____("salary_in_usd")
# Show the result
CA_jobs.____()