Filtrowanie według lokalizacji firmy
Korzystając z tego samego zbioru danych co w poprzednim ćwiczeniu, stwierdzasz, że interesują cię tylko oferty pracy na poziomie podstawowym ("EN") w Kanadzie ("CA"). Jak wyglądają tam wynagrodzenia?
Pamiętaj, że w twoim środowisku pracy jest już dostępna sesja SparkSession o nazwie spark!
To ćwiczenie jest częścią kursu
Wprowadzenie do PySpark
Instrukcje do ćwiczenia
- Przefiltruj ramkę danych, aby uwzględnić tylko wiersze, w których
company_locationma wartość"CA". - Oblicz średnią wartość kolumny
salary_in_usd. - Wyświetl wynik!
Interaktywne ćwiczenie praktyczne
Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.
# Average salary for entry level in Canada
CA_jobs = ca_salaries_df.____(ca_salaries_df[____] == "CA").filter(ca_salaries_df['experience_level']
== "EN").groupBy().____("salary_in_usd")
# Show the result
CA_jobs.____()