시작하기무료로 시작하기

R 코퍼스 탐색하기

동료가 원유(crude oil)에 대해 다룬 20개의 문서로 코퍼스를 준비했으며, 이름은 crude입니다. 이것은 다음 주에 받게 될 수천 개 기사 중 일부 샘플일 뿐이에요. 이 문서들에 대해 텍스트 분석을 수행할 준비를 하기 위해, 콘텐츠와 메타데이터를 살펴보려고 합니다. R에서는 VCorpus가 각 텍스트의 metacontent를 모두 포함한다는 점을 기억하세요. 이번 연습에서는 이 두 객체를 탐색해 보겠습니다.

이 연습은 강의의 일부입니다

R로 배우는 자연어 처리 입문

강의 보기

연습 안내

  • crude를 출력하고 결과를 확인하세요.
  • 10번째 기사의 내용을 출력하세요.
  • crude에서 첫 번째 기사의 ID를 출력하세요.
  • 제공된 for 루프를 사용해 코퍼스에서 ID를 벡터로 만드세요.

실습형 인터랙티브 연습

이 예제를 이 샘플 코드를 완성하여 풀어보세요.

# Print out the corpus
print(___)

# Print the content of the 10th article
crude[[___]]$___

# Find the first ID
crude[[___]]$___$id

# Make a vector of IDs
ids <- c()
for(i in c(1:20)){
  ids <- append(ids, crude[[___]]$___$id)
}
코드 편집 및 실행