Kom igångKom igång gratis

Lösa partiella dubbletter

Datamängden parking_violation har ändrats och innehåller nu en kolumn fee som anger avgiften för överträdelsen. Den här kolumnen är användbar för att hålla koll på New York Citys intäkter från parkeringsböter. På grund av duplicerade poster i datamängden skulle intäktsberäkningar dock inte bli korrekta. Dessa duplicerade poster skiljer sig bara åt i värdet i kolumnen fee – alla övriga kolumnvärden är identiska. Beslutet har fattats att använda den lägsta avgiften (fee) för att lösa den tvetydighet som dubblerna skapar.

Identifiera de 3 duplicerade posterna i parking_violation och använd funktionen MIN() för att avgöra vilken fee som ska användas efter att dubblerna har tagits bort.

Den här övningen är en del av kursen

Datarensning i PostgreSQL-databaser

Visa kurs

Övningsinstruktioner

  • Returnera summons_number och den lägsta fee för duplicerade poster.
  • Gruppera resultaten efter summons_number.
  • Begränsa resultaten till poster där antalet summons_number är större än 1.

Interaktiv övning med praktiskt arbete

Testa den här övningen genom att slutföra den här exempelkoden.

SELECT 
	-- Include SELECT list columns
	___, 
    ___(___) AS fee
FROM 
	parking_violation 
GROUP BY
	-- Define column for GROUP BY
	___ 
HAVING 
	-- Restrict to summons numbers with count greater than 1
	___(___) ___ ___;
Redigera och kör kod