Zacznij terazZacznij za darmo

Podobieństwo dokumentów w spaCy

Podobieństwo semantyczne polega na analizie wielu zdań w celu wykrycia zależności między nimi. W tym ćwiczeniu przećwiczysz obliczanie podobieństwa semantycznego dokumentów względem wskazanego dokumentu bazowego. Celem jest kategoryzacja listy recenzji powiązanych z karmą dla psów w puszce.

Kategoria karma dla psów w puszce jest przechowywana w zmiennej category. Próbka pięciu recenzji żywności została dostarczona w liście o nazwie texts. Model en_core_web_md jest załadowany jako nlp.

To ćwiczenie jest częścią kursu

Przetwarzanie języka naturalnego z użyciem spaCy

Zobacz kurs

Instrukcje do ćwiczenia

  • Utwórz listę documents zawierającą obiekty Doc dla wszystkich elementów listy texts.
  • Utwórz obiekt Doc dla zmiennej category i zapisz go jako category_document.
  • Przejdź przez elementy listy documents i wyświetl wyniki podobieństwa każdego obiektu Doc względem category_document, zaokrąglone do trzech miejsc po przecinku.

Interaktywne ćwiczenie praktyczne

Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.

# Create a documents list containing Doc containers
documents = [____ for t in texts]

# Create a Doc container of the category
category = "canned dog food"
category_document = ____(____)

# Print similarity scores of each Doc container and the category_document
for i, doc in enumerate(documents):
  print(f"Semantic similarity with document {i+1}:", round(doc.____(____), 3))
Edytuj i uruchom kod