ПочатиПочніть безкоштовно

Контейнер Doc у spaCy

Перший крок конвеєра обробки тексту в spaCy — перетворити наданий рядок тексту на контейнер Doc, який зберігає опрацьований текст. У цій вправі ви потренуєтеся завантажувати модель spaCy, створювати об'єкт nlp(), створювати контейнер Doc і обробляти рядок text, який уже доступний для вас.

Модель en_core_web_sm уже завантажено.

Ця вправа є частиною курсу

Обробка природної мови (NLP) зі spaCy

Переглянути курс

Інструкції до вправи

  • Завантажте en_core_web_sm і створіть об'єкт nlp.
  • Створіть контейнер doc з рядка text.
  • Створіть список, що містить текст кожного токена в контейнері doc.

Інтерактивна практична вправа

Спробуйте виконати цю вправу, доповнивши цей зразок коду.

# Load en_core_web_sm and create an nlp object
nlp = spacy.____(____)

# Create a Doc container for the text object
doc = ____(____)

# Create a list containing the text of each token in the Doc container
print([____ for ____ in ____])
Редагувати та запускати код