НачатьНачать бесплатно

Читабельность различных изданий

В этом упражнении вам предоставлены отрывки из статей четырёх изданий. Ваша задача — вычислить читабельность этих отрывков с помощью индекса Ганнинга и определить относительную сложность чтения каждого издания.

Отрывки доступны в виде следующих строк:

  • forbes — отрывок из статьи журнала Forbes о китайской системе социального рейтинга.
  • harvard_law — отрывок из рецензии на книгу, опубликованной в Harvard Law Review.
  • r_digest — отрывок из статьи Reader's Digest о турбулентности в полётах.
  • time_kids — отрывок из статьи о вреде избыточного потребления соли, опубликованной в TIME for Kids.

Это упражнение является частью курса

Конструирование признаков для NLP на Python

Посмотреть курс

Инструкции к упражнению

  • Импортируйте класс Readability из модуля readability.
  • Вычислите объект gf для каждого отрывка excerpt, вызвав метод gunning_fog() на объекте Readability.
  • Получите значение индекса Ганнинга с помощью атрибута score.
  • Выведите список значений индекса Ганнинга.

Интерактивное практическое упражнение

Попробуйте выполнить это упражнение, дополнив этот пример кода.

# Import Readability
from readability import Readability

# List of excerpts
excerpts = [forbes, harvard_law, r_digest, time_kids]

# Loop through excerpts and compute gunning fog index
gunning_fog_scores = []
for excerpt in excerpts:
  gf = Readability(excerpt).____()
  gf_score = gf.____
  gunning_fog_scores.append(gf_score)
  
# Print the gunning fog indices
print(gunning_fog_scores)
Редактировать и запускать код