ÎncepețiÎncepe gratuit

Rezolvarea duplicatelor parțiale

Setul de date parking_violation a fost modificat pentru a include o coloană fee, care indică amenda aferentă contravenției. Această coloană ar fi utilă pentru urmărirea veniturilor din amenzile de parcare din New York City. Totuși, din cauza înregistrărilor duplicate, calculele de venituri bazate pe acest set de date nu ar fi corecte. Înregistrările duplicate diferă doar prin valoarea din coloana fee — toate celelalte valori din coloane sunt identice. S-a decis utilizarea valorii minime a fee pentru a rezolva ambiguitatea creată de aceste duplicate.

Identifică cele 3 înregistrări duplicate din parking_violation și folosește funcția MIN() pentru a determina valoarea fee care va fi utilizată după eliminarea duplicatelor.

Acest exercițiu face parte din cursul

Curățarea datelor în baze de date PostgreSQL

Vezi cursul

Instrucțiuni pentru exercițiu

  • Returnează summons_number și valoarea minimă a fee pentru înregistrările duplicate.
  • Grupează rezultatele după summons_number.
  • Restricționează rezultatele la înregistrările al căror număr de apariții (count) pentru summons_number este mai mare decât 1.

Exercițiu interactiv practic

Încearcă acest exercițiu completând acest cod de exemplu.

SELECT 
	-- Include SELECT list columns
	___, 
    ___(___) AS fee
FROM 
	parking_violation 
GROUP BY
	-- Define column for GROUP BY
	___ 
HAVING 
	-- Restrict to summons numbers with count greater than 1
	___(___) ___ ___;
Editează și rulează codul