공통 열을 기준으로 두 DataFrame을 병합하고, 일치하는 행만 반환하려면 어떤 연산을 사용해야 하나요?
이 연습은 강의의 일부입니다
이론을 실습으로 바꾸는 인터랙티브 연습 중 하나를 만나보세요
PySpark와 분산 컴퓨팅에 대한 일반적인 소개입니다. 이 섹션에서는 PySpark, PySpark DataFrame, 그리고 RDD를 소개합니다.
DataFrame과 복합 데이터 타입에 대한 심화 내용입니다. 이 섹션은 PySpark에서 DataFrame이 제공하는 기능을 확장해 설명하고 일부 Spark SQL 개념을 소개합니다.
현재 연습
대규모 데이터 처리를 위해 SQL의 단순성과 PySpark의 분산 컴퓨팅 성능을 결합하는 방법을 살펴봅니다. Spark SQL과 PySpark를 활용해 큰 데이터셋을 효율적으로 처리해 보세요.