Kom igångKom igång gratis

Vad försöker vi förutsäga?

Vilket av dessa fält (eller kolumner) är det värde vi försöker förutsäga?

  • TAXES
  • SALESCLOSEPRICE
  • DAYSONMARKET
  • LISTPRICE

Den här övningen är en del av kursen

Feature Engineering med PySpark

Visa kurs

Övningsinstruktioner

  • Identifiera bland kolumnerna ovan vilken som ska användas som beroende variabel $Y$.
  • Använd den inlästa datamängden df och filtrera den till enbart den beroende variabeln med select(). Lagra denna dataframe i variabeln Y_df.
  • Visa sammanfattande statistik för den beroende variabeln genom att anropa describe()Y_df och sedan show() för att visa resultatet.

Interaktiv övning med praktiskt arbete

Testa den här övningen genom att slutföra den här exempelkoden.

# Select our dependent variable
Y_df = df.____([____])

# Display summary statistics
Y_df.____().____()
Redigera och kör kod