시작하기무료로 시작하기

데이터 분포 분석하기

많은 제품 관리자는 자신이 담당하는 제품 기능과 관련된 데이터를 잘 탐색합니다. 이 시나리오에서 여러분은 소셜 미디어 애플리케이션의 뉴스피드를 담당하는 데이터에 밝은 제품 관리자입니다. 뉴스피드 데이터 수집 인프라에 이상치가 섞여 있는 문제가 있을 수 있다고 의심합니다. 표본 기간별 기사당 평균 조회수가 일반적인 조회수에 비해 지나치게 높게 치우쳐 있습니다.

먼저, 일주일 보고 기간 동안 상위 5개 기사의 읽기 행동을 살펴보며, 인기 있지만 전형적인 기사 5개의 읽기 패턴이 어떤지 감을 잡아봅니다.

dc_news_dimdc_news_fact 테이블을 사용할 수 있습니다.

이 연습은 강의의 일부입니다

PostgreSQL로 살펴보는 시계열 분석

강의 보기

실습형 인터랙티브 연습

이 예제를 이 샘플 코드를 완성하여 풀어보세요.

-- Calculate the max, average, and continuous median views
SELECT
  ___ AS max,
  ___ AS average,
  ___ AS median
FROM dc_news_fact;
코드 편집 및 실행