Filtrování podle společnosti
Pracuješ se stejným datasetem jako v předchozím cvičení a zjistíš, že tě zajímají jen pozice na vstupní úrovni ("EN") v Kanadě ("CA"). Jak to tam vypadá s platy?
Mimochodem, v tvém pracovním prostředí už je připravena SparkSession s názvem spark!
Toto cvičení je součástí kurzu
Introduction to PySpark
Pokyny k cvičení
- Vyfiltruj DataFrame tak, aby obsahoval pouze záznamy, kde
company_locationje"CA". - Vypočítej průměr sloupce
salary_in_usd. - Zobraz výsledek!
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Average salary for entry level in Canada
CA_jobs = ca_salaries_df.____(ca_salaries_df[____] == "CA").filter(ca_salaries_df['experience_level']
== "EN").groupBy().____("salary_in_usd")
# Show the result
CA_jobs.____()