Zacznij terazZacznij za darmo

Co chcemy przewidywać?

Które z tych pól (kolumn) jest wartością, którą chcemy przewidzieć?

  • TAXES
  • SALESCLOSEPRICE
  • DAYSONMARKET
  • LISTPRICE

To ćwiczenie jest częścią kursu

Inżynieria cech z PySpark

Zobacz kurs

Instrukcje do ćwiczenia

  • Spośród wymienionych powyżej kolumn wskaż tę, która posłuży jako zmienna zależna $Y$.
  • Korzystając z wczytanego zbioru danych df, odfiltruj go do zmiennej zależnej za pomocą select(). Wynik zapisz w zmiennej Y_df.
  • Wyświetl statystyki opisowe zmiennej zależnej, wywołując describe() na Y_df, a następnie show(), aby je pokazać.

Interaktywne ćwiczenie praktyczne

Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.

# Select our dependent variable
Y_df = df.____([____])

# Display summary statistics
Y_df.____().____()
Edytuj i uruchom kod