Inizia subitoInizia gratis

Risolvere duplicati imparziali

Il dataset parking_violation è stato modificato per includere una colonna fee che indica l'importo della sanzione. Questa colonna è utile per tenere traccia degli introiti derivanti dalle multe per sosta a New York City. Tuttavia, a causa di record di violazioni duplicati, i calcoli del gettito basati sul dataset non sarebbero accurati. Questi record duplicati differiscono solo per il valore nella colonna fee. Tutti gli altri valori di colonna sono identici nei record duplicati. Si è deciso di usare il valore minimo di fee per risolvere l'ambiguità creata da questi duplicati.

Individua i 3 record duplicati di parking_violation e usa la funzione MIN() per determinare il fee che verrà utilizzato dopo la rimozione dei duplicati.

Questo esercizio fa parte del corso

Pulizia dei dati nei database PostgreSQL

Visualizza corso

Istruzioni dell'esercizio

  • Restituisci summons_number e il valore minimo di fee per i record duplicati.
  • Raggruppa i risultati per summons_number.
  • Limita i risultati ai record con un conteggio di summons_number maggiore di 1.

esercizio interattivo pratico

Prova questo esercizio completando questo codice di esempio.

SELECT 
	-- Include SELECT list columns
	___, 
    ___(___) AS fee
FROM 
	parking_violation 
GROUP BY
	-- Define column for GROUP BY
	___ 
HAVING 
	-- Restrict to summons numbers with count greater than 1
	___(___) ___ ___;
Modifica ed esegui il codice