R 코퍼스 탐색하기
동료가 원유(crude oil)에 대해 다룬 20개의 문서로 코퍼스를 준비했으며, 이름은 crude입니다. 이것은 다음 주에 받게 될 수천 개 기사 중 일부 샘플일 뿐이에요. 이 문서들에 대해 텍스트 분석을 수행할 준비를 하기 위해, 콘텐츠와 메타데이터를 살펴보려고 합니다. R에서는 VCorpus가 각 텍스트의 meta와 content를 모두 포함한다는 점을 기억하세요. 이번 연습에서는 이 두 객체를 탐색해 보겠습니다.
이 연습은 강의의 일부입니다
R로 배우는 자연어 처리 입문
연습 안내
crude를 출력하고 결과를 확인하세요.- 10번째 기사의 내용을 출력하세요.
crude에서 첫 번째 기사의 ID를 출력하세요.- 제공된 for 루프를 사용해 코퍼스에서 ID를 벡터로 만드세요.
실습형 인터랙티브 연습
이 예제를 이 샘플 코드를 완성하여 풀어보세요.
# Print out the corpus
print(___)
# Print the content of the 10th article
crude[[___]]$___
# Find the first ID
crude[[___]]$___$id
# Make a vector of IDs
ids <- c()
for(i in c(1:20)){
ids <- append(ids, crude[[___]]$___$id)
}