Dataförberedelse
Du håller på att bygga en maskininlärningsmodell som använder NLP för ett sentimentanalys-projekt som klassificerar restaurangrecensioner som positiva, negativa eller neutrala. För att förbereda data inför träning måste du förbehandla textdata och representera den numeriskt.
Din datamängd innehåller tusentals recensioner, varav en lyder:
"The food was delicious, but the service was extremely slow."
Vilka förbehandlingssteg för text tar troligen bort orden "but" och "was" från den här recensionen?
Den här övningen är en del av kursen
Koncept inom stora språkmodeller (LLM)
Interaktiv övning med praktiskt arbete
Gör teori till handling med en av våra interaktiva övningar
Starta övningen