시작하기무료로 시작하기

그룹별 요약

twitter_data에는 불만 트윗보다 일반 트윗이 더 많네요. 이 데이터가 정말 Twitter에서 온 게 맞는지 살짝 의문이 들 수도 있겠어요! 트윗 본문을 보기 전에 살펴보면 좋은 열이 몇 가지 더 있습니다. 각 트윗에는 해당 사용자의 팔로워 수가 usr_followers_count 열에 포함돼 있어요. 불만을 제기한 사용자가 평균적으로 불만을 제기하지 않은 사용자보다 팔로워가 더 많을까요, 적을까요? 그룹별 요약을 사용하면 이에 대한 답을 빠르고 쉽게 확인할 수 있습니다.

이 연습은 강의의 일부입니다

R로 시작하는 텍스트 분석

강의 보기

연습 안내

  • complaint_label로 데이터를 그룹화하세요.
  • usr_followers_count의 평균, 최솟값, 최댓값을 계산하세요.

실습형 인터랙티브 연습

이 예제를 이 샘플 코드를 완성하여 풀어보세요.

# Start with the data frame
___ %>% 
  # Group the data by whether or not the tweet is a complaint
  ___(___) %>% 
  # Compute the mean, min, and max follower counts
  summarize(
    avg_followers = ___(___),
    min_followers = ___(___),
    max_followers = ___(___)
  )
코드 편집 및 실행