or
Den här övningen är en del av kursen
Lär dig grunderna i textbearbetning inom Natural Language Processing (NLP). Du får öva på tekniker som tokenisering, borttagning av stoppord och skiljetecken samt textnormalisering med gemener, stemming och lemmatisering – för att förbereda textdata för vidare analys.
Omvandla råtext till användbara numeriska särdrag. Skapa bag-of-words- och TF-IDF-representationer för att fånga ordens betydelse i olika dokument, och utforska sedan ordembeddings som Word2Vec och GloVe för att hitta djupare semantiska mönster. Visualisera frekvens, relevans och likhet för att ge din textdata liv.
Använd förtränade modeller för avancerade textklassificeringsuppgifter. Arbeta med Hugging Face-pipelines för sentimentanalys, ämnesklassificering och naturlig språkinferens. Utvärdera semantisk likhet och grammatisk korrekthet med moderna modeller – utan att behöva bygga något från grunden.
Fördjupa dig i kärnan av moderna NLP-tillämpningar med tokenklassificering och textgenerering. Lär dig att extrahera entiteter och grammatiska strukturer med NER och PoS-taggning. Öva på både extraktiv och abstrakt frågebesvarande, och utforska avancerade genereringsuppgifter som sammanfattning, översättning och språkmodellering med Hugging Face-pipelines.
Aktuell övning