將推文載入 DataFrame
現在是時候把資料載入 pandas 的 DataFrame,這樣你就能大規模分析推文了。
我們要處理的資料集包含含有 '#rstats' 或 '#python' 標籤的推文。這個資料集以推文 JSON 物件的清單形式,儲存在 data_science_json 中。
本課程會涵蓋許多你可能一時想不起來的觀念。需要快速複習時,下載並隨手參考這份 pandas 基本語法小抄!
請注意,這是來自 Twitter 的真實資料,因此可能會包含粗俗語言或其他具冒犯性的內容(本練習以及之後所有使用真實 Twitter 資料的練習皆然)。
本練習屬於課程
使用 Python 分析社群媒體資料
練習說明
- 匯入
pandas(記得依慣例將別名設為pd)。 - 使用
flatten_tweets()將data_science_json的推文攤平,並儲存到tweets。 - 使用
pd.DataFrame()以tweets建立一個 DataFrame。 - 列印前 5 筆推文的文字內容。
動手互動練習
試著完成這個範例程式碼,體驗一下這個練習。
# Import pandas
import ____ as ____
# Flatten the tweets and store in `tweets`
tweets = ____(____)
# Create a DataFrame from `tweets`
ds_tweets = ____(____)
# Print out the first 5 tweets from this dataset
print(ds_tweets[____].values[0:5])