복합 집계
내장 집계 메서드를 더 익히기 위해, 이번에는 조금 더 복잡한 집계를 해 보겠습니다! 목표는 이 명령들을 한 줄로 합치는 것입니다.
워크스페이스에는 이미 spark라는 SparkSession과 Spark DataFrame인 salaries_df가 준비되어 있다는 점을 기억하세요.
이 연습은 강의의 일부입니다
PySpark 입문
연습 안내
"salary_in_usd"열을 사용해 미국 대기업의 평균 급여를 계산하세요.- 미국 대기업의 총 급여를 계산하세요.
실습형 인터랙티브 연습
이 예제를 이 샘플 코드를 완성하여 풀어보세요.
# Average salaries at large us companies
large_companies=salaries_df.filter(salaries_df.company_size == "L").filter(salaries_df.company_location == "US").groupBy().____
#set a large companies variable for other analytics
large_companies=salaries_df.filter(salaries_df.company_size == "L").filter(salaries_df.company_location == "US")
# Total salaries in usd
large_companies.groupBy().____.show()