Фільтрування за компанією
Використовуючи той самий набір даних із попередньої вправи, ви зрозуміли, що вас цікавлять лише посади початкового рівня ("EN") у Канаді ("CA"). Які там зарплати?
Пам'ятайте, у вашому робочому середовищі вже є SparkSession з назвою spark!
Ця вправа є частиною курсу
Вступ до PySpark
Інструкції до вправи
- Відфільтруйте датафрейм, залишивши лише рядки, де
company_locationдорівнює"CA". - Обчисліть середнє значення стовпця
salary_in_usd. - Покажіть результат!
Інтерактивна практична вправа
Спробуйте виконати цю вправу, доповнивши цей зразок коду.
# Average salary for entry level in Canada
CA_jobs = ca_salaries_df.____(ca_salaries_df[____] == "CA").filter(ca_salaries_df['experience_level']
== "EN").groupBy().____("salary_in_usd")
# Show the result
CA_jobs.____()