시작하기무료로 시작하기

시계열별 데이터 개수 세기

다른 팀이 가져오기 파일에서 업로드한 날씨 시계열 데이터를 평가하는 팀에서 데이터 과학자로 일하고 있으며, 이 새 데이터셋의 활용도를 분석해 달라는 요청을 받았어요.

데이터가 담긴 두 개의 테이블이 있습니다. 각 시계열은 filename, station_id, 그리고 두 글자의 state 코드로 식별됩니다. 그중 두 개의 관측소(station)는 다른 관측소보다 데이터 포인트가 적다는 설명을 들었습니다.

데이터 포인트 수가 가장 적은 두 관측소가 어디인지, 데이터 포인트 수 오름차순으로 정렬해 보여 주는 쿼리를 작성하세요.

temperature_stationstemperatures_monthly 테이블을 사용할 수 있습니다.

이 연습은 강의의 일부입니다

PostgreSQL로 살펴보는 시계열 분석

강의 보기

연습 안내

  • 두 테이블을 조인하고 관측소별 데이터 개수를 세어, 오름차순으로 정렬하세요.

실습형 인터랙티브 연습

이 예제를 이 샘플 코드를 완성하여 풀어보세요.

-- Count the number of data per station, sorted in ascending order
SELECT filename, state, ___ AS count
FROM temperatures_monthly
JOIN ___ USING(___)
GROUP BY filename, state
___;
코드 편집 및 실행