Risolvere duplicati imparziali
Il dataset parking_violation è stato modificato per includere una colonna fee che indica l'importo della sanzione. Questa colonna è utile per tenere traccia degli introiti derivanti dalle multe per sosta a New York City. Tuttavia, a causa di record di violazioni duplicati, i calcoli del gettito basati sul dataset non sarebbero accurati. Questi record duplicati differiscono solo per il valore nella colonna fee. Tutti gli altri valori di colonna sono identici nei record duplicati. Si è deciso di usare il valore minimo di fee per risolvere l'ambiguità creata da questi duplicati.
Individua i 3 record duplicati di parking_violation e usa la funzione MIN() per determinare il fee che verrà utilizzato dopo la rimozione dei duplicati.
Questo esercizio fa parte del corso
Pulizia dei dati nei database PostgreSQL
Istruzioni dell'esercizio
- Restituisci
summons_numbere il valore minimo difeeper i record duplicati. - Raggruppa i risultati per
summons_number. - Limita i risultati ai record con un conteggio di
summons_numbermaggiore di 1.
esercizio interattivo pratico
Prova questo esercizio completando questo codice di esempio.
SELECT
-- Include SELECT list columns
___,
___(___) AS fee
FROM
parking_violation
GROUP BY
-- Define column for GROUP BY
___
HAVING
-- Restrict to summons numbers with count greater than 1
___(___) ___ ___;