Zacznij terazZacznij za darmo

Filtrowanie według lokalizacji firmy

Korzystając z tego samego zbioru danych co w poprzednim ćwiczeniu, stwierdzasz, że interesują cię tylko oferty pracy na poziomie podstawowym ("EN") w Kanadzie ("CA"). Jak wyglądają tam wynagrodzenia? Pamiętaj, że w twoim środowisku pracy jest już dostępna sesja SparkSession o nazwie spark!

To ćwiczenie jest częścią kursu

Wprowadzenie do PySpark

Zobacz kurs

Instrukcje do ćwiczenia

  • Przefiltruj ramkę danych, aby uwzględnić tylko wiersze, w których company_location ma wartość "CA".
  • Oblicz średnią wartość kolumny salary_in_usd.
  • Wyświetl wynik!

Interaktywne ćwiczenie praktyczne

Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.

# Average salary for entry level in Canada
CA_jobs = ca_salaries_df.____(ca_salaries_df[____] == "CA").filter(ca_salaries_df['experience_level']
 == "EN").groupBy().____("salary_in_usd")

# Show the result
CA_jobs.____()
Edytuj i uruchom kod