Inizia subitoInizia gratis

Cosa stiamo prevedendo?

Quale di questi campi (o colonne) è il valore che vogliamo prevedere?

  • TAXES
  • SALESCLOSEPRICE
  • DAYSONMARKET
  • LISTPRICE

Questo esercizio fa parte del corso

Feature Engineering con PySpark

Visualizza corso

Istruzioni dell'esercizio

  • Tra le colonne elencate sopra, individua quella che useremo come variabile dipendente $Y$.
  • Usando l'insieme di dati caricato df, filtra la variabile dipendente con select(). Salva questo dataframe nella variabile Y_df.
  • Mostra le statistiche riassuntive della variabile dipendente usando describe() su Y_df e chiamando show() per visualizzarle.

esercizio interattivo pratico

Prova questo esercizio completando questo codice di esempio.

# Select our dependent variable
Y_df = df.____([____])

# Display summary statistics
Y_df.____().____()
Modifica ed esegui il codice