Фильтрация по местонахождению компании
Работая с тем же набором данных, что и в предыдущем упражнении, вы решили сосредоточиться только на позициях начального уровня ("EN") в Канаде ("CA"). Как выглядят зарплаты на таких должностях?
Напомним, что в вашем рабочем пространстве уже создана сессия SparkSession с именем spark!
Это упражнение является частью курса
Введение в PySpark
Инструкции к упражнению
- Отфильтруйте DataFrame, оставив только строки, где
company_locationравно"CA". - Вычислите среднее значение столбца
salary_in_usd. - Выведите результат!
Интерактивное практическое упражнение
Попробуйте выполнить это упражнение, дополнив этот пример кода.
# Average salary for entry level in Canada
CA_jobs = ca_salaries_df.____(ca_salaries_df[____] == "CA").filter(ca_salaries_df['experience_level']
== "EN").groupBy().____("salary_in_usd")
# Show the result
CA_jobs.____()