Функція для «сплющення» твіта
Нас зазвичай цікавлять сотні або тисячі твітів. Тому доцільно визначити функцію, яка «сплющує» файл JSON із твітами. Назвімо цю функцію flatten_tweets(). Ми використовуватимемо її кілька разів у цьому курсі й трохи змінюватимемо залежно від типу даних.
json уже завантажено для вас.
Ця вправа є частиною курсу
Аналіз даних із соцмереж у Python
Інструкції до вправи
- Збережіть ім'я користувача (screen name) в
user-screen_name. - Збережіть розширений текст твіта в
extended_tweet-full_text. - Збережіть ім'я користувача ретвіта в
retweeted_status-user-screen_name. - Збережіть текст ретвіта в
retweeted_status-text.
Інтерактивна практична вправа
Спробуйте виконати цю вправу, доповнивши цей зразок коду.
def flatten_tweets(tweets_json):
""" Flattens out tweet dictionaries so relevant JSON
is in a top-level dictionary."""
tweets_list = []
# Iterate through each tweet
for tweet in tweets_json:
tweet_obj = json.loads(tweet)
# Store the user screen name in 'user-screen_name'
tweet_obj[____] = ____
# Check if this is a 140+ character tweet
if 'extended_tweet' in tweet_obj:
# Store the extended tweet text in 'extended_tweet-full_text'
tweet_obj[____] = ____
if 'retweeted_status' in tweet_obj:
# Store the retweet user screen name in 'retweeted_status-user-screen_name'
tweet_obj[____] = ____
# Store the retweet text in 'retweeted_status-text'
tweet_obj[____] = ____
tweets_list.append(tweet_obj)
return tweets_list