Lösa partiella dubbletter
Datamängden parking_violation har ändrats och innehåller nu en kolumn fee som anger avgiften för överträdelsen. Den här kolumnen är användbar för att hålla koll på New York Citys intäkter från parkeringsböter. På grund av duplicerade poster i datamängden skulle intäktsberäkningar dock inte bli korrekta. Dessa duplicerade poster skiljer sig bara åt i värdet i kolumnen fee – alla övriga kolumnvärden är identiska. Beslutet har fattats att använda den lägsta avgiften (fee) för att lösa den tvetydighet som dubblerna skapar.
Identifiera de 3 duplicerade posterna i parking_violation och använd funktionen MIN() för att avgöra vilken fee som ska användas efter att dubblerna har tagits bort.
Den här övningen är en del av kursen
Datarensning i PostgreSQL-databaser
Övningsinstruktioner
- Returnera
summons_numberoch den lägstafeeför duplicerade poster. - Gruppera resultaten efter
summons_number. - Begränsa resultaten till poster där antalet
summons_numberär större än 1.
Interaktiv övning med praktiskt arbete
Testa den här övningen genom att slutföra den här exempelkoden.
SELECT
-- Include SELECT list columns
___,
___(___) AS fee
FROM
parking_violation
GROUP BY
-- Define column for GROUP BY
___
HAVING
-- Restrict to summons numbers with count greater than 1
___(___) ___ ___;