Bắt đầu ngayBắt đầu miễn phí

Đếm loại người dùng

Đếm tần suất là dạng tóm tắt cốt lõi cho dữ liệu phân loại. Vì văn bản là dữ liệu phân loại, bạn cần quen với việc tính số đếm. twitter_data gồm cả tweet phàn nàn và không phàn nàn, được chỉ ra bởi cột complaint_label, và còn có cột usr_verified cho biết người dùng đã được xác minh hay chưa (tức là họ đã được Twitter xác nhận danh tính). Lưu ý cột này có kiểu <lgl>, nghĩa là logical. Người dùng đã xác minh có phàn nàn nhiều hơn không?

Bài tập này là một phần của khóa học

Nhập môn Phân tích Văn bản bằng R

Xem khóa học

Hướng dẫn bài tập

  • Nạp gói tidyverse, bao gồm dplyrggplot2.
  • Lọc dữ liệu để chỉ giữ các tweet là phàn nàn.
  • Đếm số người dùng đã xác minh và chưa xác minh đã đăng tweet phàn nàn.

Bài tập tương tác thực hành trực tiếp

Hãy thử làm bài tập này bằng cách hoàn thành đoạn mã mẫu này.

# Load the tidyverse package
___(___)

twitter_data %>% 
  # Filter for just the complaints
  ___(___) %>% 
  # Count the number of verified and non-verified users
  ___(___)
Chỉnh sửa và Chạy Mã