Zacznij terazZacznij za darmo

Tworzenie zmiennej dummy dla zmiennej dwukategorialnej

Dany jest basetable z jedną zmienną predykcyjną "gender". Upewnij się, że "gender" może być użyta jako zmienna predykcyjna w modelu regresji logistycznej – w tym celu utwórz dla niej zmienne dummy.

To ćwiczenie jest częścią kursu

Pośrednia analityka predykcyjna w Pythonie

Zobacz kurs

Instrukcje do ćwiczenia

  • Utwórz ramkę danych pandas dummies_gender zawierającą zmienne dummy dla "gender". Pamiętaj, aby uniknąć współliniowości.
  • Dodaj te zmienne dummy do oryginalnego basetable.
  • Usuń oryginalną zmienną "gender" z basetable.

Interaktywne ćwiczenie praktyczne

Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.

# Create the dummy variable
dummies_gender = pd.____(____["____"], drop_first=____)

# Add the dummy variable to the basetable
basetable = pd.concat([____, ____], axis=1)

# Delete the original variable from the basetable
del basetable["____"]
print(basetable.head())
Edytuj i uruchom kod