회사별 필터링
이전 연습 문제와 같은 데이터셋을 사용해요. 이제 캐나다("CA")에서 신입("EN") 수준의 채용 공고만 관심 있다고 가정해 봅시다. 그 경우 급여는 어떻게 보이나요?
워크스페이스에는 이미 SparkSession인 spark가 준비되어 있어요!
이 연습은 강의의 일부입니다
PySpark 입문
연습 안내
company_location이"CA"인 행만 남기도록 DataFrame을 필터링하세요.salary_in_usd열의 평균을 계산하세요.- 결과를 출력하세요!
실습형 인터랙티브 연습
이 예제를 이 샘플 코드를 완성하여 풀어보세요.
# Average salary for entry level in Canada
CA_jobs = ca_salaries_df.____(ca_salaries_df[____] == "CA").filter(ca_salaries_df['experience_level']
== "EN").groupBy().____("salary_in_usd")
# Show the result
CA_jobs.____()