시작하기무료로 시작하기

모든 캡처 그룹 매칭하기

이 연습 문제에서는 영화 제목과 해당 순위를 저장한 top_10이라는 텍스트 파일을 사용합니다. 이 여러 줄 텍스트에서 줄바꿈은 \\n으로 표시됩니다. str_split() 함수를 사용해 텍스트 파일을 여러 줄로 분할할 거예요.

새로 생성된 한 행짜리 행렬 top_10_lines에는 동일한 패턴을 가진 열 줄이 들어 있습니다. 영화의 순위, 그다음 점과 공백, 그리고 영화 제목 순서예요. str_match() 함수와 두 개의 캡처 그룹 ()을 사용하면, 이 두 정보를 일반 텍스트에서 표 형태로 추출할 수 있습니다.

이 연습은 강의의 일부입니다

R 중급 정규 표현식

강의 보기

연습 안내

  • str_split() 함수를 사용해 텍스트를 줄 단위로 분할하고, simplify를 활성화해 문자 행렬을 출력하세요.
  • 한 줄의 구조를 파악하세요. 한 줄에는 영화의 순위와 제목이 들어 있습니다.
  • str_match() 함수에서 캡처 그룹을 사용해 영화의 순위와 제목을 추출하세요.

실습형 인터랙티브 연습

이 예제를 이 샘플 코드를 완성하여 풀어보세요.

# Split the input by line break and enable simplify
top_10_lines <- str_split(
  top_10,
  pattern = "___",
  simplify = ___
)

# Inspect the first three lines and analyze their form
___[1:3]

# Add to the pattern two capturing groups that match rank and title
str_match(
  top_10_lines,
  pattern = "___\\. ___"
)
코드 편집 및 실행