BaşlayınÜcretsiz başlayın

Sözlük ve korpus oluştur

Bir LDA konu modeli çalıştırabilmek için önce sözlüğünü ve korpusunu tanımlaman gerekir; çünkü model bunları girdi olarak kullanır. Önceki egzersizlerde temizlediğin metin verisi üzerinde çalışmaya devam edeceksin. Yani text_clean zaten senin için hazır; bunu kullanarak sözlüğünü ve korpusunu oluşturacaksın.

Bu egzersizin çalışması alıştığından biraz daha uzun sürebilir.

Bu egzersiz, kursun bir parçasıdır

Python ile Sahtekarlık Tespiti

Kursa Göz Atın

Egzersiz talimatları

  • gensim paketini ve ayrıca gensim içinden corpora modülünü içe aktar.
  • Temiz verin text_clean üzerinde doğru fonksiyonu çalıştırarak sözlüğünü tanımla.
  • text_clean içindeki her metin parçası için doc2bow çalıştırarak korpusu tanımla.
  • Sonuçlarını yazdır ki dictionary ve corpus nasıl görünüyor görebilesin.

Uygulamalı etkileşimli egzersiz

Bu egzersizi bu örnek kodu tamamlayarak deneyin.

# Import the packages
import ____
from ____ import ____

# Define the dictionary
dictionary = ____.____(____)

# Define the corpus 
corpus = [dictionary.____(text) for ___ in ____]

# Print corpus and dictionary
print(____)
print(____)
Kodu Düzenle ve Çalıştır