Začněte nyníZačněte zdarma

Příprava vektorů štítků

Ve video lekci jsi se dozvěděl/a o rozdílech mezi binární klasifikací a klasifikací do více tříd. Naučil/a ses, že před trénováním modelů je potřeba provést určité úpravy v procesu přípravy dat.

V tomto cvičení připravíš surový dataset, jehož štítky jsou zadané jako text. Data jsou k dispozici jako pandas.DataFrame s názvem df se dvěma sloupci: text s textovými daty a label s názvy štítků. Tvým úkolem je provést všechny potřebné transformace štítků: převést řetězce na čísla a aplikovat one-hot encoding.

Modul pandas jako pd a funkce to_categorical() z keras.utils.np_utils jsou v prostředí již načteny a na konzoli jsou zobrazeny první řádky datasetu.

Toto cvičení je součástí kurzu

Rekurentní neuronové sítě (RNN) pro jazykové modelování s Keras

Zobrazit kurz

Interaktivní cvičení na vyzkoušení si v praxi

Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.

# Get the numerical ids of column label
numerical_ids = df.label.____

# Print initial shape
print(numerical_ids.____)
Upravit a spustit kód