ÎncepețiÎncepe gratuit

Rularea unui pipeline spaCy

Ai rulat deja un pipeline NLP spaCy pe un singur text și ai extras tokenii dintr-o listă de containere Doc. În acest exercițiu, vei exersa pașii inițiali ai rulării unui pipeline spaCy pe texts, care este o listă de șiruri de text.

Vei folosi modelul en_core_web_sm în acest scop. Pachetul spaCy a fost deja importat pentru tine.

Acest exercițiu face parte din cursul

Procesarea limbajului natural cu spaCy

Vezi cursul

Instrucțiuni pentru exercițiu

  • Încarcă modelul en_core_web_sm ca nlp.
  • Rulează modelul nlp() pe fiecare element din texts și adaugă fiecare container Doc corespunzător într-o listă documents.
  • Afișează textele tokenilor pentru fiecare container Doc din lista documents.

Exercițiu interactiv practic

Încearcă acest exercițiu completând acest cod de exemplu.

# Load en_core_web_sm model as nlp
nlp = spacy.____(____)

# Run an nlp model on each item of texts and append the Doc container to documents
documents = []
for text in ____:
  documents.append(____)
  
# Print the token texts for each Doc container
for doc in documents:
  print([____ for ____ in ____])
Editează și rulează codul