การเพิ่มขึ้นครั้งใหญ่ที่สุดของชื่อ
ก่อนหน้านี้ คุณได้เพิ่มคอลัมน์ ratio เพื่อแสดงอัตราส่วนความถี่ของชื่อเด็กระหว่างปีที่ต่อเนื่องกัน ซึ่งช่วยอธิบายการเปลี่ยนแปลงของความนิยมในแต่ละชื่อ ในแบบฝึกหัดนี้ จะพิจารณาข้อมูลชุดย่อยที่ชื่อว่า babynames_ratios_filtered เพื่อเจาะลึกถึงชื่อที่มีความนิยมเพิ่มขึ้นมากที่สุดในปีที่ติดกัน
babynames_ratios_filtered <- babynames_fraction %>%
arrange(name, year) %>%
group_by(name) %>%
mutate(ratio = fraction / lag(fraction)) %>%
filter(fraction >= 0.00001)
แบบฝึกหัดนี้เป็นส่วนหนึ่งของหลักสูตร
การจัดการข้อมูลด้วย dplyr
คำแนะนำการฝึกหัด
- จากแต่ละชื่อในข้อมูล ให้เก็บเฉพาะการสังเกต (ปี) ที่มีค่า
ratioสูงสุดไว้ โดยข้อมูลถูกจัดกลุ่มตามnameไว้แล้ว - เรียงลำดับคอลัมน์
ratioจากมากไปน้อย - กรองข้อมูล
babynames_ratios_filteredเพิ่มเติมโดยกรองคอลัมน์fractionให้แสดงเฉพาะค่าที่มากกว่าหรือเท่ากับ0.001
แบบฝึกหัดเชิงโต้ตอบแบบลงมือทำ
ลองทำแบบฝึกหัดนี้โดยเติมโค้ดตัวอย่างนี้ให้สมบูรณ์
babynames_ratios_filtered %>%
# Extract the largest ratio from each name
___
# Sort the ratio column in descending order
___
# Filter for fractions greater than or equal to 0.001
___