ÎncepețiÎncepe gratuit

Similaritatea documentelor cu spaCy

Similaritatea semantică reprezintă procesul de analiză a mai multor propoziții pentru a identifica asemănările dintre ele. În acest exercițiu, vei exersa calcularea similarității semantice a unor documente față de un document de referință. Scopul este să clasifici o listă de recenzii relevante pentru categoria hrană umedă pentru câini.

Categoria hrană umedă pentru câini este stocată în category. Un eșantion de cinci recenzii alimentare a fost furnizat într-o listă numită texts. en_core_web_md este încărcat ca nlp.

Acest exercițiu face parte din cursul

Procesarea limbajului natural cu spaCy

Vezi cursul

Instrucțiuni pentru exercițiu

  • Creează o listă documents care să conțină containere Doc pentru toate elementele din texts.
  • Creează un container Doc pentru category și stochează-l ca category_document.
  • Parcurge documents și afișează scorurile de similaritate ale fiecărui container Doc față de category_document, rotunjite la trei zecimale.

Exercițiu interactiv practic

Încearcă acest exercițiu completând acest cod de exemplu.

# Create a documents list containing Doc containers
documents = [____ for t in texts]

# Create a Doc container of the category
category = "canned dog food"
category_document = ____(____)

# Print similarity scores of each Doc container and the category_document
for i, doc in enumerate(documents):
  print(f"Semantic similarity with document {i+1}:", round(doc.____(____), 3))
Editează și rulează codul