基于主题识别欺诈者
在本练习中,您将把主题模型的结果回连到原始数据。您已经知道需要对与主题 3 相关的所有内容进行标记。不过,正如您将看到的,这并不那么直接。您会得到函数 get_topic_details(),它接收参数 ldamodel 和 corpus,用于提取每一行文本的主题细节。借助该函数,您可以把结果追加回原始数据。若您想进一步了解如何使用模型结果(超出本课程范围),强烈建议阅读这篇文章。
已为您提供 dictionary、corpus、清洗后的文本数据 text_clean,以及模型结果 ldamodel。函数 get_topic_details() 也已定义。
本练习是课程的一部分
Python 中的欺诈检测
交互式实操练习
通过完成这段示例代码来试试这个练习。
# Run get_topic_details function and check the results
print(get_topic_details(____, ____))