Filtrer par entreprise
En reprenant le même jeu de données que dans l'exercice précédent, vous réalisez que vous vous intéressez seulement aux emplois de niveau débutant ("EN") au Canada ("CA"). À quoi ressemblent les salaires dans ce cas?
Rappelez-vous qu'une SparkSession appelée spark est déjà disponible dans votre espace de travail!
Cette activité fait partie du cours
Introduction à PySpark
Instructions de l’exercice
- Filtrez pour restreindre le DataFrame aux lignes où
company_locationest"CA". - Calculez la moyenne de la colonne
salary_in_usd. - Affichez le résultat!
Exercice interactif pratique
Essayez cet exercice en complétant ce code d’exemple.
# Average salary for entry level in Canada
CA_jobs = ca_salaries_df.____(ca_salaries_df[____] == "CA").filter(ca_salaries_df['experience_level']
== "EN").groupBy().____("salary_in_usd")
# Show the result
CA_jobs.____()