Resolvendo duplicatas parciais
O conjunto de dados parking_violation foi modificado para incluir uma coluna fee indicando a taxa da infração. Essa coluna é útil para acompanhar a arrecadação de multas de estacionamento na cidade de Nova York. No entanto, devido a registros de infração duplicados, os cálculos de receita com base no conjunto de dados não seriam precisos. Esses registros duplicados diferem apenas no valor da coluna fee. Todos os outros valores de coluna são idênticos nos registros duplicados. Decidiu-se usar o fee mínimo para resolver a ambiguidade criada por essas duplicatas.
Identifique os 3 registros duplicados de parking_violation e use a função MIN() para determinar o fee que será utilizado após remover os registros duplicados.
Este exercicio faz parte do curso
Limpeza de dados em bancos de dados PostgreSQL
Instruções do exercicio
- Retorne o
summons_numbere ofeemínimo para registros duplicados. - Agrupe os resultados por
summons_number. - Restrinja os resultados a registros cujo count de
summons_numberseja maior que 1.
exercicio interativo prático
Tente este exercicio completando este código de exemplo.
SELECT
-- Include SELECT list columns
___,
___(___) AS fee
FROM
parking_violation
GROUP BY
-- Define column for GROUP BY
___
HAVING
-- Restrict to summons numbers with count greater than 1
___(___) ___ ___;