方法複習 #2
在這個練習中,你會複習另外四種方法。
e:用於將文字依照使用到的相似詞彙分成群組或類型的建模技術,包括 LDA。f:一種在文字中搜尋並標註可用來識別人物、地點或組織的詞彙的方法。g:用於在文字中搜尋特定樣式的方法。h:以大型向量空間來表示詞彙的方法,在此空間中,相似的詞彼此距離較近。
本練習屬於課程
R 的自然語言處理入門
練習說明
- 依照上面 4 個描述,將對應的模型或方法設為相應的字母。
動手互動練習
試著完成這個範例程式碼,體驗一下這個練習。
# Named Entity Recognition
NER <- ___
# Topic Modeling
TM <- ___
# Word Embeddings
WE <- ___
# Regular Expressions
REGEX <- ___