Comece agoraComece grátis

Resolvendo duplicatas parciais

O conjunto de dados parking_violation foi modificado para incluir uma coluna fee indicando a taxa da infração. Essa coluna é útil para acompanhar a arrecadação de multas de estacionamento na cidade de Nova York. No entanto, devido a registros de infração duplicados, os cálculos de receita com base no conjunto de dados não seriam precisos. Esses registros duplicados diferem apenas no valor da coluna fee. Todos os outros valores de coluna são idênticos nos registros duplicados. Decidiu-se usar o fee mínimo para resolver a ambiguidade criada por essas duplicatas.

Identifique os 3 registros duplicados de parking_violation e use a função MIN() para determinar o fee que será utilizado após remover os registros duplicados.

Este exercicio faz parte do curso

Limpeza de dados em bancos de dados PostgreSQL

Ver curso

Instruções do exercicio

  • Retorne o summons_number e o fee mínimo para registros duplicados.
  • Agrupe os resultados por summons_number.
  • Restrinja os resultados a registros cujo count de summons_number seja maior que 1.

exercicio interativo prático

Tente este exercicio completando este código de exemplo.

SELECT 
	-- Include SELECT list columns
	___, 
    ___(___) AS fee
FROM 
	parking_violation 
GROUP BY
	-- Define column for GROUP BY
	___ 
HAVING 
	-- Restrict to summons numbers with count greater than 1
	___(___) ___ ___;
Editar e Executar Código