트윗 평탄화 함수
보통은 수백 개에서 수천 개의 트윗에 관심이 있어요. 이를 위해 트윗이 담긴 JSON 파일을 평탄화하는 함수를 정의하는 것이 좋습니다. 이 함수를 flatten_tweets()라고 하죠. 이 코스 전반에서 이 함수를 여러 번 사용하고, 데이터 유형에 따라 조금씩 수정할 거예요.
json은 미리 로드해 두었습니다.
이 연습은 강의의 일부입니다
Python으로 소셜 미디어 데이터 분석하기
연습 안내
- 사용자 스크린 네임을
user-screen_name에 저장하세요. - 확장 트윗 텍스트를
extended_tweet-full_text에 저장하세요. - 리트윗한 사용자 스크린 네임을
retweeted_status-user-screen_name에 저장하세요. - 리트윗 텍스트를
retweeted_status-text에 저장하세요.
실습형 인터랙티브 연습
이 예제를 이 샘플 코드를 완성하여 풀어보세요.
def flatten_tweets(tweets_json):
""" Flattens out tweet dictionaries so relevant JSON
is in a top-level dictionary."""
tweets_list = []
# Iterate through each tweet
for tweet in tweets_json:
tweet_obj = json.loads(tweet)
# Store the user screen name in 'user-screen_name'
tweet_obj[____] = ____
# Check if this is a 140+ character tweet
if 'extended_tweet' in tweet_obj:
# Store the extended tweet text in 'extended_tweet-full_text'
tweet_obj[____] = ____
if 'retweeted_status' in tweet_obj:
# Store the retweet user screen name in 'retweeted_status-user-screen_name'
tweet_obj[____] = ____
# Store the retweet text in 'retweeted_status-text'
tweet_obj[____] = ____
tweets_list.append(tweet_obj)
return tweets_list