เริ่มต้นใช้งานเริ่มต้นใช้งานได้ฟรี

การตรวจสอบจำนวนระดับ

dplyr มีฟังก์ชันอีกสองตัวที่มีประโยชน์มากเมื่อต้องการสำรวจชุดข้อมูล ตัวแรกคือ slice_max(var, n = x) ซึ่งดึง x แถวแรกของชุดข้อมูลโดยเรียงตามค่าของ var ส่วนอีกตัวคือ pull() ซึ่งช่วยให้ดึงข้อมูลจากคอลัมน์ออกมาเป็นค่าล้วน ๆ โดยไม่มีชื่อคอลัมน์ติดมาด้วย

ตัวอย่างเช่น หากต้องการดึงค่า mpg สูงสุด 2 อันดับแรกจากชุดข้อมูลคลาสสิกอย่าง mtcars ออกมาเป็นชุดค่า สามารถเขียนได้ดังนี้:

mtcars %>%
  slice_max(mpg, n = 2) %>%
  pull(mpg)

ผลลัพธ์ที่ได้คือ:

[1] 32.4 33.9

แบบฝึกหัดนี้เป็นส่วนหนึ่งของหลักสูตร

ข้อมูลเชิงหมวดหมู่ใน Tidyverse

ดูคอร์ส

คำแนะนำการฝึกหัด

  • ใช้ slice_max() เพื่อแสดง 3 แถวที่มีจำนวนระดับของ factor มากที่สุด
  • กรองข้อมูลสำหรับตัวแปร CurrentJobTitleSelect แล้วใช้ pull เพื่อดึงจำนวนระดับที่ตัวแปรนั้นมี

แบบฝึกหัดเชิงโต้ตอบแบบลงมือทำ

ลองทำแบบฝึกหัดนี้โดยเติมโค้ดตัวอย่างนี้ให้สมบูรณ์

# Select the 3 rows with the highest number of levels
number_of_levels %>%
    ___(num_levels, n = 3)
    
number_of_levels %>%
	# Filter for where the column called variable equals CurrentJobTitleSelect
    filter(___) %>%
	# Pull num_levels
    ___
แก้ไขและรันโค้ด