Читабельность различных изданий
В этом упражнении вам предоставлены отрывки из статей четырёх изданий. Ваша задача — вычислить читабельность этих отрывков с помощью индекса Ганнинга и определить относительную сложность чтения каждого издания.
Отрывки доступны в виде следующих строк:
forbes— отрывок из статьи журнала Forbes о китайской системе социального рейтинга.harvard_law— отрывок из рецензии на книгу, опубликованной в Harvard Law Review.r_digest— отрывок из статьи Reader's Digest о турбулентности в полётах.time_kids— отрывок из статьи о вреде избыточного потребления соли, опубликованной в TIME for Kids.
Это упражнение является частью курса
Конструирование признаков для NLP на Python
Инструкции к упражнению
- Импортируйте класс
Readabilityиз модуляreadability. - Вычислите объект
gfдля каждого отрывкаexcerpt, вызвав методgunning_fog()на объектеReadability. - Получите значение индекса Ганнинга с помощью атрибута
score. - Выведите список значений индекса Ганнинга.
Интерактивное практическое упражнение
Попробуйте выполнить это упражнение, дополнив этот пример кода.
# Import Readability
from readability import Readability
# List of excerpts
excerpts = [forbes, harvard_law, r_digest, time_kids]
# Loop through excerpts and compute gunning fog index
gunning_fog_scores = []
for excerpt in excerpts:
gf = Readability(excerpt).____()
gf_score = gf.____
gunning_fog_scores.append(gf_score)
# Print the gunning fog indices
print(gunning_fog_scores)