НачатьНачать бесплатно

Фильтрация по местонахождению компании

Работая с тем же набором данных, что и в предыдущем упражнении, вы решили сосредоточиться только на позициях начального уровня ("EN") в Канаде ("CA"). Как выглядят зарплаты на таких должностях? Напомним, что в вашем рабочем пространстве уже создана сессия SparkSession с именем spark!

Это упражнение является частью курса

Введение в PySpark

Посмотреть курс

Инструкции к упражнению

  • Отфильтруйте DataFrame, оставив только строки, где company_location равно "CA".
  • Вычислите среднее значение столбца salary_in_usd.
  • Выведите результат!

Интерактивное практическое упражнение

Попробуйте выполнить это упражнение, дополнив этот пример кода.

# Average salary for entry level in Canada
CA_jobs = ca_salaries_df.____(ca_salaries_df[____] == "CA").filter(ca_salaries_df['experience_level']
 == "EN").groupBy().____("salary_in_usd")

# Show the result
CA_jobs.____()
Редактировать и запускать код