시작하기무료로 시작하기

오버 플로팅 1: 대규모 데이터세트

산포도(geom_point() 사용)는 직관적이고 이해하기 쉬우며 매우 널리 사용됩니다. 하지만 특히 다음 네 가지 상황에서는 오버 플로팅항상 고려해야 합니다.

  1. 대규모 데이터세트
  2. 단일 축에 값이 정렬된 경우
  3. 정밀도가 낮은 데이터
  4. 정수형 데이터

일반적으로 내부가 채워진 모양을 사용할 때는 알파 블렌딩, 즉 투명도를 추가하는 것이 좋습니다. 또는 불투명하면서 내부가 비어 있는 모양을 사용할 수도 있습니다.

작은 점은 여러 점이 겹쳐 데이터 밀도가 높은 영역이 있는 대규모 데이터세트에 적합합니다.

diamonds 데이터세트를 활용해 대규모 데이터세트의 오버 플로팅 처리 방법을 연습해 보겠습니다.

이 연습은 강의의 일부입니다

ggplot2로 시작하는 데이터 시각화

강의 보기

실습형 인터랙티브 연습

이 예제를 이 샘플 코드를 완성하여 풀어보세요.

# Plot price vs. carat, colored by clarity
plt_price_vs_carat_by_clarity <- ggplot(diamonds, aes(carat, price, color = clarity))

# Add a point layer with tiny points
plt_price_vs_carat_by_clarity + ___
코드 편집 및 실행