การ Tokenize และนับคำ
สำรวจเนื้อหาของทวีตสายการบินใน twitter_data ผ่านการนับคำ โดยเนื้อหาของแต่ละทวีตอยู่ในคอลัมน์ tweet_text
แบบฝึกหัดนี้เป็นส่วนหนึ่งของหลักสูตร
การวิเคราะห์ข้อความเบื้องต้นใน R
คำแนะนำการฝึกหัด
- โหลดแพ็กเกจ tidyverse และ tidytext
- Tokenize ทวีตในคอลัมน์
tweet_text - คำนวณจำนวนคำโดยใช้ข้อความที่ผ่านการ tokenize แล้ว
- เรียงลำดับจำนวนคำจากมากไปน้อย
แบบฝึกหัดเชิงโต้ตอบแบบลงมือทำ
ลองทำแบบฝึกหัดนี้โดยเติมโค้ดตัวอย่างนี้ให้สมบูรณ์
# Load the tidyverse and tidytext packages
___(___)
___(___)
tidy_twitter <- twitter_data %>%
# Tokenize the twitter data
___(word, ___)
tidy_twitter %>%
# Compute word counts
___(___) %>%
# Arrange the counts in descending order
___(___)