CommencezCommencez gratuitement

Filtrer par entreprise

En reprenant le même jeu de données que dans l'exercice précédent, vous réalisez que vous vous intéressez seulement aux emplois de niveau débutant ("EN") au Canada ("CA"). À quoi ressemblent les salaires dans ce cas? Rappelez-vous qu'une SparkSession appelée spark est déjà disponible dans votre espace de travail!

Cette activité fait partie du cours

Introduction à PySpark

Voir le cours

Instructions de l’exercice

  • Filtrez pour restreindre le DataFrame aux lignes où company_location est "CA".
  • Calculez la moyenne de la colonne salary_in_usd.
  • Affichez le résultat!

Exercice interactif pratique

Essayez cet exercice en complétant ce code d’exemple.

# Average salary for entry level in Canada
CA_jobs = ca_salaries_df.____(ca_salaries_df[____] == "CA").filter(ca_salaries_df['experience_level']
 == "EN").groupBy().____("salary_in_usd")

# Show the result
CA_jobs.____()
Modifier et exécuter le code