Nhóm và biến đổi các cột tương tự
Trong bài học này, bạn đã thấy cách một số cột trong bộ dữ liệu khảo sát khoa học dữ liệu của Kaggle có liên quan với nhau, chẳng hạn các cột nói về tần suất của những thách thức trong công việc. Ta thường muốn xem các biến đó cùng nhau, nhưng trước hết, cần tìm chúng và chuyển chúng về định dạng dễ dùng hơn. Hãy thử quy trình này với các câu hỏi về mức độ hữu ích của những nền tảng học tập theo đánh giá của người tham gia khảo sát.
Bộ dữ liệu multiple_choice_responses đã được nạp sẵn cho bạn.
Bài tập này là một phần của khóa học
Dữ liệu phân loại trong Tidyverse
Hướng dẫn bài tập
- Chỉ chọn các cột có
"LearningPlatformUsefulness"trong tên. - Chuyển dữ liệu từ dạng rộng sang dạng dài với hai cột,
learning_platformvàusefulness. - Loại bỏ các hàng mà
usefulnesslà NA. - Xóa
"LearningPlatformUsefulness"khỏi mỗi chuỗi tronglearning_platform.
Bài tập tương tác thực hành trực tiếp
Hãy thử làm bài tập này bằng cách hoàn thành đoạn mã mẫu này.
learning_platform_usefulness <- multiple_choice_responses %>%
# Select columns with LearningPlatformUsefulness in title
___(___("LearningPlatformUsefulness")) %>%
# Change data from wide to long
___(everything(), names_to = "learning_platform", values_to = "usefulness") %>%
# Remove rows where usefulness is NA
___(___()) %>%
# Remove "LearningPlatformUsefulness" from each string in learning_platform
mutate(learning_platform = ___())