นับจำนวน Favorites
มาต่อกันด้วยการสำรวจชุดข้อมูล RStudio Conf กัน ชุดข้อมูลนี้เป็นลิสต์ที่มีซับลิสต์มากกว่า 5,000 รายการ โดยแต่ละซับลิสต์คือทวีตที่มีแฮชแท็ก #RStudioConf
ในแบบฝึกหัดนี้ เราจะดึงค่าสถิติจากทวีตที่ไม่ใช่ retweet นั่นคือค่าเฉลี่ยของจำนวน favorites โดยองค์ประกอบ "favorite_count" ในแต่ละซับลิสต์คือจำนวนคนที่กด like ทวีตนั้น
purrr ถูกโหลดไว้ให้แล้ว และชุดข้อมูล rstudioconf ยังคงพร้อมใช้งานใน workspace ของคุณ
แบบฝึกหัดนี้เป็นส่วนหนึ่งของหลักสูตร
Functional Programming ระดับกลางด้วย purrr
คำแนะนำการฝึกหัด
Prefill ฟังก์ชัน
mean()และround()ด้วยna.rm = TRUEและdigits = 1สร้างฟังก์ชันใหม่จากฟังก์ชันที่ prefill ไว้ทั้งสอง และตั้งชื่อว่า
rounded_mean()สร้างซับลิสต์ที่ประกอบด้วยเฉพาะทวีตที่ไม่ใช่ retweet
ดึงองค์ประกอบ
"favorite_count"จากแต่ละซับลิสต์โดยใช้map_*เวอร์ชันสำหรับจำนวนเต็ม แล้วส่งผลลัพธ์ไปยังrounded_mean()
แบบฝึกหัดเชิงโต้ตอบแบบลงมือทำ
ลองทำแบบฝึกหัดนี้โดยเติมโค้ดตัวอย่างนี้ให้สมบูรณ์
# Prefill mean() with na.rm, and round() with digits = 1
mean_na_rm <- ___(___, ___)
round_one <- ___(___, ___)
# Compose a rounded_mean function
rounded_mean <- ___(___, ___)
# Extract the non retweet
non_rt <- ___(___, "is_retweet")
# Extract "favorite_count", and pass it to rounded_mean()
non_rt %>%
map_dbl("___") %>%
___()