Začněte nyníZačněte zdarma

Filtrování podle společnosti

Pracuješ se stejným datasetem jako v předchozím cvičení a zjistíš, že tě zajímají jen pozice na vstupní úrovni ("EN") v Kanadě ("CA"). Jak to tam vypadá s platy? Mimochodem, v tvém pracovním prostředí už je připravena SparkSession s názvem spark!

Toto cvičení je součástí kurzu

Introduction to PySpark

Zobrazit kurz

Pokyny k cvičení

  • Vyfiltruj DataFrame tak, aby obsahoval pouze záznamy, kde company_location je "CA".
  • Vypočítej průměr sloupce salary_in_usd.
  • Zobraz výsledek!

Interaktivní cvičení na vyzkoušení si v praxi

Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.

# Average salary for entry level in Canada
CA_jobs = ca_salaries_df.____(ca_salaries_df[____] == "CA").filter(ca_salaries_df['experience_level']
 == "EN").groupBy().____("salary_in_usd")

# Show the result
CA_jobs.____()
Upravit a spustit kód