모든 캡처 그룹 매칭하기
이 연습 문제에서는 영화 제목과 해당 순위를 저장한 top_10이라는 텍스트 파일을 사용합니다. 이 여러 줄 텍스트에서 줄바꿈은 \\n으로 표시됩니다. str_split() 함수를 사용해 텍스트 파일을 여러 줄로 분할할 거예요.
새로 생성된 한 행짜리 행렬 top_10_lines에는 동일한 패턴을 가진 열 줄이 들어 있습니다. 영화의 순위, 그다음 점과 공백, 그리고 영화 제목 순서예요. str_match() 함수와 두 개의 캡처 그룹 ()을 사용하면, 이 두 정보를 일반 텍스트에서 표 형태로 추출할 수 있습니다.
이 연습은 강의의 일부입니다
R 중급 정규 표현식
연습 안내
str_split()함수를 사용해 텍스트를 줄 단위로 분할하고,simplify를 활성화해 문자 행렬을 출력하세요.- 한 줄의 구조를 파악하세요. 한 줄에는 영화의 순위와 제목이 들어 있습니다.
str_match()함수에서 캡처 그룹을 사용해 영화의 순위와 제목을 추출하세요.
실습형 인터랙티브 연습
이 예제를 이 샘플 코드를 완성하여 풀어보세요.
# Split the input by line break and enable simplify
top_10_lines <- str_split(
top_10,
pattern = "___",
simplify = ___
)
# Inspect the first three lines and analyze their form
___[1:3]
# Add to the pattern two capturing groups that match rank and title
str_match(
top_10_lines,
pattern = "___\\. ___"
)