Запуск конвейера spaCy
Вы уже запускали NLP-конвейер spaCy на отдельном тексте и извлекали токены из списка контейнеров Doc. В этом упражнении вы потренируетесь выполнять начальные шаги: запустите конвейер spaCy на наборе texts — списке текстовых строк.
Для этого вы будете использовать модель en_core_web_sm. Пакет spaCy уже импортирован.
Это упражнение является частью курса
Обработка естественного языка с помощью spaCy
Инструкции к упражнению
- Загрузите модель
en_core_web_smкакnlp. - Примените модель
nlp()к каждому элементу спискаtextsи добавьте соответствующий контейнерDocв списокdocuments. - Выведите тексты токенов для каждого контейнера
Docиз спискаdocuments.
Интерактивное практическое упражнение
Попробуйте выполнить это упражнение, дополнив этот пример кода.
# Load en_core_web_sm model as nlp
nlp = spacy.____(____)
# Run an nlp model on each item of texts and append the Doc container to documents
documents = []
for text in ____:
documents.append(____)
# Print the token texts for each Doc container
for doc in documents:
print([____ for ____ in ____])