Zacznij terazZacznij za darmo

Kontener Doc w spaCy

Pierwszym krokiem potoku przetwarzania tekstu w spaCy jest przekształcenie podanego ciągu tekstowego w kontener Doc, który przechowuje przetworzony tekst. W tym ćwiczeniu przećwiczysz wczytywanie modelu spaCy, tworzenie obiektu nlp(), tworzenie kontenera Doc oraz przetwarzanie dostępnego ciągu text.

Model en_core_web_sm jest już pobrany.

To ćwiczenie jest częścią kursu

Przetwarzanie języka naturalnego z użyciem spaCy

Zobacz kurs

Instrukcje do ćwiczenia

  • Wczytaj en_core_web_sm i utwórz obiekt nlp.
  • Utwórz kontener doc z ciągu text.
  • Utwórz listę zawierającą tekst każdego tokena z kontenera doc.

Interaktywne ćwiczenie praktyczne

Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.

# Load en_core_web_sm and create an nlp object
nlp = spacy.____(____)

# Create a Doc container for the text object
doc = ____(____)

# Create a list containing the text of each token in the Doc container
print([____ for ____ in ____])
Edytuj i uruchom kod