1. Learn
  2. /
  3. Курси
  4. /
  5. Обробка природної мови (NLP) зі spaCy

Connected

Вправа

Сегментація речень у spaCy

У цій вправі ви попрактикуєтеся в сегментації речень. В обробці природної мови поділ документа на речення — корисна базова операція. Це один із перших кроків у багатьох складніших завданнях НЛП, наприклад виявленні іменованих сутностей. Крім того, кількість речень може підказати, скільки інформації містить текст.

У вас є доступ до десяти відгуків про їжу в списку texts.

Модель en_core_web_sm уже завантажено як nlp і .

Інструкції

100 XP
  • Запустіть модель spaCy для кожного елемента у списку texts, щоб зібрати documents — список усіх контейнерів Doc.
  • Видобудьте речення з кожного контейнера doc, ітеруючись списком documents, і додайте їх до списку sentences.
  • Порахуйте кількість речень у кожному контейнері doc, використовуючи список sentences.