Feature engineering
Tvým úkolem je předpovědět, zda nová skupina žadatelů o půjčku pravděpodobně nesplatí své závazky. Máš k dispozici historická data a chceš na nich natrénovat klasifikátor. Všimneš si, že mnoho příznaků je ve formátu řetězců, což je pro klasifikátory problém. Rozhodneš se proto zakódovat sloupce s řetězci numericky pomocí LabelEncoder(). Tato funkce je předem načtená z podmodulu preprocessing knihovny sklearn. Dataset credit je také předem načtený, stejně jako seznam názvů všech sloupců s datovým typem řetězec, uložený v non_numeric_columns.
Toto cvičení je součástí kurzu
Designing Machine Learning Workflows in Python
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Inspect the first few lines of your data using head()
credit.____