2단계: 텍스트 원천 식별하기
직원 리뷰는 다양한 경로에서 수집될 수 있어요. 인사(HR) 부서에 충분한 자원이 있다면, 외부 업체에 의뢰해 포커스 그룹을 진행하고 자사 직원과 경쟁사 직원을 인터뷰할 수도 있겠죠.
Forbes 등에서는 "일하기 좋은 곳"에 관한 기사를 발행하며, 여기에는 Amazon과 Google이 언급될 수 있어요. 또 다른 정보 출처로는 Indeed, Glassdoor, CareerBliss 같은 웹사이트의 익명 온라인 리뷰가 있어요.
여기서는 익명 온라인 리뷰 모음에 초점을 맞추겠습니다.
이 연습은 강의의 일부입니다
R로 배우는 Bag-of-Words 텍스트 마이닝
연습 안내
str()로amzn의 구조를 확인해 차원과 데이터 미리 보기를 살펴보세요.- 긍정 리뷰 열
amzn$pros에서amzn_pros를 만드세요. - 부정 리뷰 열
amzn$cons에서amzn_cons를 만드세요. str()로goog의 구조를 출력해 차원과 데이터 미리 보기를 확인하세요.- 긍정 리뷰 열
goog$pros에서goog_pros를 만드세요. - 부정 리뷰 열
goog$cons에서goog_cons를 만드세요.
실습형 인터랙티브 연습
이 예제를 이 샘플 코드를 완성하여 풀어보세요.
# Print the structure of amzn
___
# Create amzn_pros
___ <- ___
# Create amzn_cons
___ <- ___
# Print the structure of goog
___(___)
# Create goog_pros
___ <- ___
# Create goog_cons
___ <- ___