НачатьНачать бесплатно

Запуск конвейера spaCy

Вы уже запускали NLP-конвейер spaCy на отдельном тексте и извлекали токены из списка контейнеров Doc. В этом упражнении вы потренируетесь выполнять начальные шаги: запустите конвейер spaCy на наборе texts — списке текстовых строк.

Для этого вы будете использовать модель en_core_web_sm. Пакет spaCy уже импортирован.

Это упражнение является частью курса

Обработка естественного языка с помощью spaCy

Посмотреть курс

Инструкции к упражнению

  • Загрузите модель en_core_web_sm как nlp.
  • Примените модель nlp() к каждому элементу списка texts и добавьте соответствующий контейнер Doc в список documents.
  • Выведите тексты токенов для каждого контейнера Doc из списка documents.

Интерактивное практическое упражнение

Попробуйте выполнить это упражнение, дополнив этот пример кода.

# Load en_core_web_sm model as nlp
nlp = spacy.____(____)

# Run an nlp model on each item of texts and append the Doc container to documents
documents = []
for text in ____:
  documents.append(____)
  
# Print the token texts for each Doc container
for doc in documents:
  print([____ for ____ in ____])
Редактировать и запускать код