Příprava vektorů štítků
Ve video lekci jsi se dozvěděl/a o rozdílech mezi binární klasifikací a klasifikací do více tříd. Naučil/a ses, že před trénováním modelů je potřeba provést určité úpravy v procesu přípravy dat.
V tomto cvičení připravíš surový dataset, jehož štítky jsou zadané jako text. Data jsou k dispozici jako pandas.DataFrame s názvem df se dvěma sloupci: text s textovými daty a label s názvy štítků. Tvým úkolem je provést všechny potřebné transformace štítků: převést řetězce na čísla a aplikovat one-hot encoding.
Modul pandas jako pd a funkce to_categorical() z keras.utils.np_utils jsou v prostředí již načteny a na konzoli jsou zobrazeny první řádky datasetu.
Toto cvičení je součástí kurzu
Rekurentní neuronové sítě (RNN) pro jazykové modelování s Keras
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Get the numerical ids of column label
numerical_ids = df.label.____
# Print initial shape
print(numerical_ids.____)