НачатьНачать бесплатно

Контейнер Doc в spaCy

Первый шаг конвейера обработки текста в spaCy — преобразование текстовой строки в контейнер Doc, который хранит обработанный текст. В этом упражнении вы потренируетесь загружать модель spaCy, создавать объект nlp(), формировать контейнер Doc и обрабатывать доступную вам строку text.

Модель en_core_web_sm уже загружена.

Это упражнение является частью курса

Обработка естественного языка с помощью spaCy

Посмотреть курс

Инструкции к упражнению

  • Загрузите en_core_web_sm и создайте объект nlp.
  • Создайте контейнер doc для строки text.
  • Создайте список, содержащий текст каждого токена из контейнера doc.

Интерактивное практическое упражнение

Попробуйте выполнить это упражнение, дополнив этот пример кода.

# Load en_core_web_sm and create an nlp object
nlp = spacy.____(____)

# Create a Doc container for the text object
doc = ____(____)

# Create a list containing the text of each token in the Doc container
print([____ for ____ in ____])
Редактировать и запускать код