부분 중복 해결하기
parking_violation 데이터셋에 위반에 대한 수수료를 나타내는 fee 열이 추가되었습니다. 이 열은 뉴욕시 주차 위반 딱지의 수입을 추적하는 데 유용합니다. 그러나 위반 기록에 중복이 있어, 이 데이터셋을 기반으로 한 수입 계산은 정확하지 않을 수 있습니다. 이 중복 레코드는 fee 값만 다르고 다른 모든 열 값은 동일합니다. 이러한 중복으로 인한 모호성을 해결하기 위해 최소 fee 값을 사용하기로 결정했습니다.
중복된 parking_violation 레코드 3건을 확인하고, 중복 레코드를 제거한 뒤 사용할 fee 값을 MIN() 함수로 결정하세요.
이 연습은 강의의 일부입니다
PostgreSQL 데이터베이스에서 데이터 정제하기
연습 안내
- 중복된 레코드에 대해
summons_number와 최소fee를 반환하세요. - 결과를
summons_number로 그룹화하세요. summons_number의 count가 1보다 큰 레코드만 결과에 포함하세요.
실습형 인터랙티브 연습
이 예제를 이 샘플 코드를 완성하여 풀어보세요.
SELECT
-- Include SELECT list columns
___,
___(___) AS fee
FROM
parking_violation
GROUP BY
-- Define column for GROUP BY
___
HAVING
-- Restrict to summons numbers with count greater than 1
___(___) ___ ___;