Устранение неполных дубликатов
Набор данных parking_violation был изменён: в него добавлен столбец fee, указывающий размер штрафа за нарушение. Этот столбец полезен для отслеживания доходов от парковочных штрафов Нью-Йорка. Однако из-за дублирующихся записей о нарушениях расчёты доходов на основе этого набора данных будут неточными. Дублирующиеся записи отличаются только значением в столбце fee, тогда как все остальные значения совпадают. Принято решение использовать минимальное значение fee для устранения неоднозначности, вызванной этими дубликатами.
Определите 3 дублирующиеся записи в таблице parking_violation и используйте функцию MIN(), чтобы установить значение fee, которое будет применяться после удаления дубликатов.
Это упражнение является частью курса
Очистка данных в базах данных PostgreSQL
Инструкции к упражнению
- Верните
summons_numberи минимальное значениеfeeдля дублирующихся записей. - Сгруппируйте результаты по
summons_number. - Ограничьте результаты записями, у которых количество значений
summons_numberбольше 1.
Интерактивное практическое упражнение
Попробуйте выполнить это упражнение, дополнив этот пример кода.
SELECT
-- Include SELECT list columns
___,
___(___) AS fee
FROM
parking_violation
GROUP BY
-- Define column for GROUP BY
___
HAVING
-- Restrict to summons numbers with count greater than 1
___(___) ___ ___;