เริ่มต้นใช้งานเริ่มต้นใช้งานได้ฟรี

ทำความสะอาดสตริง

ในบทเรียนนี้ เราได้เรียนรู้พื้นฐานของ "regex" หรือนิพจน์ทั่วไป (regular expressions) ซึ่งช่วยให้จับคู่รูปแบบข้อความได้อย่างยืดหยุ่น โดยมี 2 สัญลักษณ์ที่ครอบคลุมไปแล้ว ดังนี้

นิพจน์ ความหมาย
. จับคู่กับอักขระใดก็ได้
* ศูนย์ครั้งขึ้นไป

ตัวอย่างเช่น ".*science " จะจับคู่กับ "data science " ในสตริง "data science rocks!"

ลองนำสิ่งที่เรียนมาใช้เพื่อแก้ไขค่าใน response_var ของชุดข้อมูลที่สร้างไว้ในบทเรียนก่อนหน้า ซึ่งก็คือ gathered_data

แบบฝึกหัดนี้เป็นส่วนหนึ่งของหลักสูตร

ข้อมูลเชิงหมวดหมู่ใน Tidyverse

ดูคอร์ส

คำแนะนำการฝึกหัด

  • ใช้ str_remove เพื่อลบข้อความทั้งหมดที่อยู่ก่อนและรวมถึง "rude to " (รวมช่องว่างท้าย) ในคอลัมน์ response_var
  • ใช้ str_remove เพื่อลบ "on a plane" ออกจากคอลัมน์ response_var

แบบฝึกหัดเชิงโต้ตอบแบบลงมือทำ

ลองทำแบบฝึกหัดนี้โดยเติมโค้ดตัวอย่างนี้ให้สมบูรณ์

gathered_data %>%
    # Remove everything before and including "rude to " (with that space at the end!)
    mutate(response_var = ___(response_var, ___)) %>%
    # Remove "on a plane"
    mutate(response_var = ___(response_var, ___))
แก้ไขและรันโค้ด