Rezolvarea duplicatelor parțiale
Setul de date parking_violation a fost modificat pentru a include o coloană fee, care indică amenda aferentă contravenției. Această coloană ar fi utilă pentru urmărirea veniturilor din amenzile de parcare din New York City. Totuși, din cauza înregistrărilor duplicate, calculele de venituri bazate pe acest set de date nu ar fi corecte. Înregistrările duplicate diferă doar prin valoarea din coloana fee — toate celelalte valori din coloane sunt identice. S-a decis utilizarea valorii minime a fee pentru a rezolva ambiguitatea creată de aceste duplicate.
Identifică cele 3 înregistrări duplicate din parking_violation și folosește funcția MIN() pentru a determina valoarea fee care va fi utilizată după eliminarea duplicatelor.
Acest exercițiu face parte din cursul
Curățarea datelor în baze de date PostgreSQL
Instrucțiuni pentru exercițiu
- Returnează
summons_numberși valoarea minimă afeepentru înregistrările duplicate. - Grupează rezultatele după
summons_number. - Restricționează rezultatele la înregistrările al căror număr de apariții (
count) pentrusummons_numbereste mai mare decât 1.
Exercițiu interactiv practic
Încearcă acest exercițiu completând acest cod de exemplu.
SELECT
-- Include SELECT list columns
___,
___(___) AS fee
FROM
parking_violation
GROUP BY
-- Define column for GROUP BY
___
HAVING
-- Restrict to summons numbers with count greater than 1
___(___) ___ ___;