Độ dễ đọc của các ấn phẩm khác nhau
Trong bài tập này, bạn được cung cấp các đoạn trích từ bài viết của bốn ấn phẩm. Nhiệm vụ của bạn là tính độ dễ đọc của các đoạn này bằng điểm Gunning fog và từ đó xác định mức độ khó/dễ tương đối khi đọc các ấn phẩm này.
Các đoạn trích có sẵn dưới dạng các chuỗi sau:
forbes- Đoạn trích từ một bài báo của tạp chí Forbes về hệ thống điểm tín nhiệm xã hội ở Trung Quốc.harvard_law- Đoạn trích từ một bài điểm sách đăng trên Harvard Law Review.r_digest- Đoạn trích từ một bài viết trên Reader's Digest về nhiễu động không khí khi bay.time_kids- Đoạn trích từ một bài viết về tác hại của việc tiêu thụ muối đăng trên TIME for Kids.
Bài tập này là một phần của khóa học
Khai thác đặc trưng cho NLP bằng Python
Hướng dẫn bài tập
- Import lớp
Readabilitytừreadability. - Tính đối tượng
gfcho mỗiexcerptbằng phương thứcgunning_fog()trênReadability. - Tính điểm Gunning fog bằng thuộc tính
score. - In danh sách các điểm Gunning fog.
Bài tập tương tác thực hành trực tiếp
Hãy thử làm bài tập này bằng cách hoàn thành đoạn mã mẫu này.
# Import Readability
from readability import Readability
# List of excerpts
excerpts = [forbes, harvard_law, r_digest, time_kids]
# Loop through excerpts and compute gunning fog index
gunning_fog_scores = []
for excerpt in excerpts:
gf = Readability(excerpt).____()
gf_score = gf.____
gunning_fog_scores.append(gf_score)
# Print the gunning fog indices
print(gunning_fog_scores)