ПочатиПочніть безкоштовно

Фільтрування за компанією

Використовуючи той самий набір даних із попередньої вправи, ви зрозуміли, що вас цікавлять лише посади початкового рівня ("EN") у Канаді ("CA"). Які там зарплати? Пам'ятайте, у вашому робочому середовищі вже є SparkSession з назвою spark!

Ця вправа є частиною курсу

Вступ до PySpark

Переглянути курс

Інструкції до вправи

  • Відфільтруйте датафрейм, залишивши лише рядки, де company_location дорівнює "CA".
  • Обчисліть середнє значення стовпця salary_in_usd.
  • Покажіть результат!

Інтерактивна практична вправа

Спробуйте виконати цю вправу, доповнивши цей зразок коду.

# Average salary for entry level in Canada
CA_jobs = ca_salaries_df.____(ca_salaries_df[____] == "CA").filter(ca_salaries_df['experience_level']
 == "EN").groupBy().____("salary_in_usd")

# Show the result
CA_jobs.____()
Редагувати та запускати код