方法回顾 #2
在本练习中,您将回顾另外 4 种方法。
e:建模技术(包括 LDA),根据所用词语的相似性将文本聚为若干组或类型。f:一种在文本中搜索并为区分人物、地点或组织的词语加标签的方法。g:用于在文本中搜索特定模式的方法。h:用高维向量空间来表示词语,在该空间中相似的词彼此更靠近。
本练习是课程的一部分
R 自然语言处理入门
练习说明
- 使用以上 4 条描述,将相应的模型或方法与对应的字母匹配。
交互式实操练习
通过完成这段示例代码来试试这个练习。
# Named Entity Recognition
NER <- ___
# Topic Modeling
TM <- ___
# Word Embeddings
WE <- ___
# Regular Expressions
REGEX <- ___