Контейнер Doc в spaCy
Первый шаг конвейера обработки текста в spaCy — преобразование текстовой строки в контейнер Doc, который хранит обработанный текст. В этом упражнении вы потренируетесь загружать модель spaCy, создавать объект nlp(), формировать контейнер Doc и обрабатывать доступную вам строку text.
Модель en_core_web_sm уже загружена.
Это упражнение является частью курса
Обработка естественного языка с помощью spaCy
Инструкции к упражнению
- Загрузите
en_core_web_smи создайте объектnlp. - Создайте контейнер
docдля строкиtext. - Создайте список, содержащий текст каждого токена из контейнера
doc.
Интерактивное практическое упражнение
Попробуйте выполнить это упражнение, дополнив этот пример кода.
# Load en_core_web_sm and create an nlp object
nlp = spacy.____(____)
# Create a Doc container for the text object
doc = ____(____)
# Create a list containing the text of each token in the Doc container
print([____ for ____ in ____])