Skapa en dummy från en tvåkategorivariabel
Du får en basetable med en prediktiv variabel, "gender". Se till att "gender" kan användas som prediktiv variabel i en logistisk regressionsmodell genom att skapa dummyvariabler för den.
Den här övningen är en del av kursen
Prediktiv analys på mellannivå i Python
Övningsinstruktioner
- Skapa en pandas-dataram
dummies_gendermed dummyvariablerna för "gender". Se till att undvika multikollinearitet. - Lägg till dessa dummies i den ursprungliga
basetable. - Ta bort den ursprungliga variabeln "gender" från
basetable.
Interaktiv övning med praktiskt arbete
Testa den här övningen genom att slutföra den här exempelkoden.
# Create the dummy variable
dummies_gender = pd.____(____["____"], drop_first=____)
# Add the dummy variable to the basetable
basetable = pd.concat([____, ____], axis=1)
# Delete the original variable from the basetable
del basetable["____"]
print(basetable.head())