ทำความสะอาดสตริง
ในบทเรียนนี้ เราได้เรียนรู้พื้นฐานของ "regex" หรือนิพจน์ทั่วไป (regular expressions) ซึ่งช่วยให้จับคู่รูปแบบข้อความได้อย่างยืดหยุ่น โดยมี 2 สัญลักษณ์ที่ครอบคลุมไปแล้ว ดังนี้
| นิพจน์ | ความหมาย |
|---|---|
. |
จับคู่กับอักขระใดก็ได้ |
* |
ศูนย์ครั้งขึ้นไป |
ตัวอย่างเช่น ".*science " จะจับคู่กับ "data science " ในสตริง "data science rocks!"
ลองนำสิ่งที่เรียนมาใช้เพื่อแก้ไขค่าใน response_var ของชุดข้อมูลที่สร้างไว้ในบทเรียนก่อนหน้า ซึ่งก็คือ gathered_data
แบบฝึกหัดนี้เป็นส่วนหนึ่งของหลักสูตร
ข้อมูลเชิงหมวดหมู่ใน Tidyverse
คำแนะนำการฝึกหัด
- ใช้
str_removeเพื่อลบข้อความทั้งหมดที่อยู่ก่อนและรวมถึง "rude to " (รวมช่องว่างท้าย) ในคอลัมน์response_var - ใช้
str_removeเพื่อลบ "on a plane" ออกจากคอลัมน์response_var
แบบฝึกหัดเชิงโต้ตอบแบบลงมือทำ
ลองทำแบบฝึกหัดนี้โดยเติมโค้ดตัวอย่างนี้ให้สมบูรณ์
gathered_data %>%
# Remove everything before and including "rude to " (with that space at the end!)
mutate(response_var = ___(response_var, ___)) %>%
# Remove "on a plane"
mutate(response_var = ___(response_var, ___))