ПочатиПочніть безкоштовно

Запуск конвеєра spaCy

Ви вже запускали конвеєр NLP у spaCy для одного фрагмента тексту, а також отримували токени для заданого списку контейнерів Doc. У цій вправі ви відпрацюєте початкові кроки запуску конвеєра spaCy для texts, тобто списку рядків із текстом.

Для цього ви використаєте модель en_core_web_sm. Пакет spaCy уже імпортовано для вас.

Ця вправа є частиною курсу

Обробка природної мови (NLP) зі spaCy

Переглянути курс

Інструкції до вправи

  • Завантажте модель en_core_web_sm як nlp.
  • Запустіть модель nlp() на кожному елементі texts і додайте відповідний контейнер Doc до списку documents.
  • Виведіть тексти токенів для кожного контейнера Doc зі списку documents.

Інтерактивна практична вправа

Спробуйте виконати цю вправу, доповнивши цей зразок коду.

# Load en_core_web_sm model as nlp
nlp = spacy.____(____)

# Run an nlp model on each item of texts and append the Doc container to documents
documents = []
for text in ____:
  documents.append(____)
  
# Print the token texts for each Doc container
for doc in documents:
  print([____ for ____ in ____])
Редагувати та запускати код