開始使用免費開始

方法複習 #2

在這個練習中,你會複習另外四種方法。

  • e:用於將文字依照使用到的相似詞彙分成群組或類型的建模技術,包括 LDA。
  • f:一種在文字中搜尋並標註可用來識別人物、地點或組織的詞彙的方法。
  • g:用於在文字中搜尋特定樣式的方法。
  • h:以大型向量空間來表示詞彙的方法,在此空間中,相似的詞彼此距離較近。

本練習屬於課程

R 的自然語言處理入門

檢視課程

練習說明

  • 依照上面 4 個描述,將對應的模型或方法設為相應的字母。

動手互動練習

試著完成這個範例程式碼,體驗一下這個練習。

# Named Entity Recognition
NER <- ___

# Topic Modeling
TM <- ___

# Word Embeddings 
WE <- ___

# Regular Expressions
REGEX <- ___
編輯並執行程式碼