Znajdowanie oszustów na podstawie tematów
W tym ćwiczeniu połączysz wyniki modelu tematycznego z oryginalnymi danymi. Wiesz już, że chcesz oflagować wszystko, co dotyczy tematu 3. Jak się przekonasz, nie jest to takie proste. Dostępna jest funkcja get_topic_details(), która przyjmuje argumenty ldamodel i corpus. Pobiera ona szczegóły tematów dla każdego wiersza tekstu. Dzięki tej funkcji możesz dołączyć wyniki z powrotem do oryginalnych danych. Jeśli chcesz dowiedzieć się więcej o pracy z wynikami modelu – co wykracza poza zakres tego kursu – zachęcamy do przeczytania tego artykułu.
Do dyspozycji masz dictionary i corpus, dane tekstowe text_clean oraz wyniki modelu ldamodel. Zdefiniowana jest również funkcja get_topic_details().
To ćwiczenie jest częścią kursu
Wykrywanie oszustw w Pythonie
Interaktywne ćwiczenie praktyczne
Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.
# Run get_topic_details function and check the results
print(get_topic_details(____, ____))