Similaritatea documentelor cu spaCy
Similaritatea semantică reprezintă procesul de analiză a mai multor propoziții pentru a identifica asemănările dintre ele. În acest exercițiu, vei exersa calcularea similarității semantice a unor documente față de un document de referință. Scopul este să clasifici o listă de recenzii relevante pentru categoria hrană umedă pentru câini.
Categoria hrană umedă pentru câini este stocată în category. Un eșantion de cinci recenzii alimentare a fost furnizat într-o listă numită texts. en_core_web_md este încărcat ca nlp.
Acest exercițiu face parte din cursul
Procesarea limbajului natural cu spaCy
Instrucțiuni pentru exercițiu
- Creează o listă
documentscare să conțină containereDocpentru toate elementele dintexts. - Creează un container
Docpentrucategoryși stochează-l cacategory_document. - Parcurge
documentsși afișează scorurile de similaritate ale fiecărui containerDocfață decategory_document, rotunjite la trei zecimale.
Exercițiu interactiv practic
Încearcă acest exercițiu completând acest cod de exemplu.
# Create a documents list containing Doc containers
documents = [____ for t in texts]
# Create a Doc container of the category
category = "canned dog food"
category_document = ____(____)
# Print similarity scores of each Doc container and the category_document
for i, doc in enumerate(documents):
print(f"Semantic similarity with document {i+1}:", round(doc.____(____), 3))