НачатьНачать бесплатно

Устранение неполных дубликатов

Набор данных parking_violation был изменён: в него добавлен столбец fee, указывающий размер штрафа за нарушение. Этот столбец полезен для отслеживания доходов от парковочных штрафов Нью-Йорка. Однако из-за дублирующихся записей о нарушениях расчёты доходов на основе этого набора данных будут неточными. Дублирующиеся записи отличаются только значением в столбце fee, тогда как все остальные значения совпадают. Принято решение использовать минимальное значение fee для устранения неоднозначности, вызванной этими дубликатами.

Определите 3 дублирующиеся записи в таблице parking_violation и используйте функцию MIN(), чтобы установить значение fee, которое будет применяться после удаления дубликатов.

Это упражнение является частью курса

Очистка данных в базах данных PostgreSQL

Посмотреть курс

Инструкции к упражнению

  • Верните summons_number и минимальное значение fee для дублирующихся записей.
  • Сгруппируйте результаты по summons_number.
  • Ограничьте результаты записями, у которых количество значений summons_number больше 1.

Интерактивное практическое упражнение

Попробуйте выполнить это упражнение, дополнив этот пример кода.

SELECT 
	-- Include SELECT list columns
	___, 
    ___(___) AS fee
FROM 
	parking_violation 
GROUP BY
	-- Define column for GROUP BY
	___ 
HAVING 
	-- Restrict to summons numbers with count greater than 1
	___(___) ___ ___;
Редактировать и запускать код