Tworzenie zmiennej dummy dla zmiennej dwukategorialnej
Dany jest basetable z jedną zmienną predykcyjną "gender". Upewnij się, że "gender" może być użyta jako zmienna predykcyjna w modelu regresji logistycznej – w tym celu utwórz dla niej zmienne dummy.
To ćwiczenie jest częścią kursu
Pośrednia analityka predykcyjna w Pythonie
Instrukcje do ćwiczenia
- Utwórz ramkę danych pandas
dummies_genderzawierającą zmienne dummy dla "gender". Pamiętaj, aby uniknąć współliniowości. - Dodaj te zmienne dummy do oryginalnego
basetable. - Usuń oryginalną zmienną "gender" z
basetable.
Interaktywne ćwiczenie praktyczne
Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.
# Create the dummy variable
dummies_gender = pd.____(____["____"], drop_first=____)
# Add the dummy variable to the basetable
basetable = pd.concat([____, ____], axis=1)
# Delete the original variable from the basetable
del basetable["____"]
print(basetable.head())