Запуск конвеєра spaCy
Ви вже запускали конвеєр NLP у spaCy для одного фрагмента тексту, а також отримували токени для заданого списку контейнерів Doc. У цій вправі ви відпрацюєте початкові кроки запуску конвеєра spaCy для texts, тобто списку рядків із текстом.
Для цього ви використаєте модель en_core_web_sm. Пакет spaCy уже імпортовано для вас.
Ця вправа є частиною курсу
Обробка природної мови (NLP) зі spaCy
Інструкції до вправи
- Завантажте модель
en_core_web_smякnlp. - Запустіть модель
nlp()на кожному елементіtextsі додайте відповідний контейнерDocдо спискуdocuments. - Виведіть тексти токенів для кожного контейнера
Docзі спискуdocuments.
Інтерактивна практична вправа
Спробуйте виконати цю вправу, доповнивши цей зразок коду.
# Load en_core_web_sm model as nlp
nlp = spacy.____(____)
# Run an nlp model on each item of texts and append the Doc container to documents
documents = []
for text in ____:
documents.append(____)
# Print the token texts for each Doc container
for doc in documents:
print([____ for ____ in ____])