When / Otherwise
Questa richiesta è simile alla precedente, ma ora vuoi aggiungere valori diversi in base alla posizione dell'elettore. Modifica il DataFrame voter_df per aggiungere un numero casuale a ogni membro votante con titolo Councilmember. Usa 2 per il Mayor e 0 per qualsiasi altra posizione.
Il Data Frame voter_df è già definito e a tua disposizione. La libreria pyspark.sql.functions è disponibile come F. Puoi usare F.rand() per generare il valore casuale.
Questo esercizio fa parte del corso
Pulizia dei dati con PySpark
Istruzioni dell'esercizio
- Aggiungi una colonna a
voter_dfchiamatarandom_valcon il risultato del metodoF.rand()per qualsiasi elettore con titolo Councilmember. Impostarandom_vala 2 per il Mayor. Imposta qualsiasi altro titolo al valore 0. - Mostra alcune righe del Data Frame, verificando se le clausole hanno funzionato.
- Usa la clausola
.filterper trovare 0 inrandom_val.
esercizio interattivo pratico
Prova questo esercizio completando questo codice di esempio.
# Add a column to voter_df for a voter based on their position
voter_df = voter_df.____('random_val',
when(voter_df.TITLE == 'Councilmember', ____)
.____(____, 2)
____
# Show some of the DataFrame rows
voter_df.show()
# Use the .filter() clause with random_val
voter_df.____(____).show()