or
Toto cvičení je součástí kurzu
Nauč se základy zpracování textu v oblasti zpracování přirozeného jazyka (NLP). Zvládneš techniky jako tokenizace, odstraňování stop slov a interpunkce a normalizace textu pomocí převodu na malá písmena, stemmingu a lemmatizace – vše pro přípravu textových dat k další analýze a získávání poznatků.
Přeměň surový text na výkonné numerické příznaky. Vytvoř reprezentace bag-of-words a TF-IDF pro zachycení důležitosti slov napříč dokumenty, a poté prozkoumej word embeddingy jako Word2Vec a GloVe k odhalení hlubokých sémantických vzorů. Vizualizuj frekvenci, relevanci a podobnost, aby tvá textová data ožila.
Aktuální cvičení
Využij sílu předtrénovaných modelů k pokročilým úlohám klasifikace textu. Pomocí Hugging Face pipeline provedeš analýzu sentimentu, klasifikaci témat a inferenci v přirozeném jazyce. Vyhodnotíš sémantickou podobnost a gramatickou správnost pomocí nejmodernějších modelů – a to vše bez nutnosti budovat cokoliv od nuly.
Ponoř se do jádra moderních NLP aplikací s technikami klasifikace tokenů a generování textu. Nauč se extrahovat smysluplné entity a gramatické struktury pomocí NER a PoS taggingu. Zvládneš jak extraktivní, tak abstraktivní zodpovídání otázek a prozkoumáš pokročilé generativní úlohy včetně sumarizace, překladu a jazykového modelování pomocí Hugging Face pipeline.