เริ่มต้นใช้งานเริ่มต้นใช้งานได้ฟรี

การ Tokenize และนับคำ

สำรวจเนื้อหาของทวีตสายการบินใน twitter_data ผ่านการนับคำ โดยเนื้อหาของแต่ละทวีตอยู่ในคอลัมน์ tweet_text

แบบฝึกหัดนี้เป็นส่วนหนึ่งของหลักสูตร

การวิเคราะห์ข้อความเบื้องต้นใน R

ดูคอร์ส

คำแนะนำการฝึกหัด

  • โหลดแพ็กเกจ tidyverse และ tidytext
  • Tokenize ทวีตในคอลัมน์ tweet_text
  • คำนวณจำนวนคำโดยใช้ข้อความที่ผ่านการ tokenize แล้ว
  • เรียงลำดับจำนวนคำจากมากไปน้อย

แบบฝึกหัดเชิงโต้ตอบแบบลงมือทำ

ลองทำแบบฝึกหัดนี้โดยเติมโค้ดตัวอย่างนี้ให้สมบูรณ์

# Load the tidyverse and tidytext packages
___(___)
___(___)

tidy_twitter <- twitter_data %>% 
  # Tokenize the twitter data
  ___(word, ___) 

tidy_twitter %>% 
  # Compute word counts
  ___(___) %>% 
  # Arrange the counts in descending order
  ___(___)
แก้ไขและรันโค้ด