Zacznij terazZacznij za darmo

Wczytywanie tweetów do DataFrame

Czas zaimportować dane do DataFrame'a biblioteki pandas, żeby móc analizować tweety na większą skalę.

Będziemy pracować ze zbiorem danych zawierającym tweety z hashtagiem '#rstats' lub '#python'. Zbiór ten jest przechowywany jako lista obiektów JSON tweetów w zmiennej data_science_json.

Kurs porusza wiele zagadnień, które mogły ci wypaść z pamięci – jeśli potrzebujesz szybkiego przypomnienia, pobierz ściągawkę z podstaw pandas i miej ją pod ręką!

Pamiętaj, że są to prawdziwe dane z Twittera, dlatego zawsze istnieje ryzyko wystąpienia wulgaryzmów lub innych nieodpowiednich treści (w tym ćwiczeniu i kolejnych, które również korzystają z rzeczywistych danych z Twittera).

To ćwiczenie jest częścią kursu

Analiza danych z mediów społecznościowych w Pythonie

Zobacz kurs

Instrukcje do ćwiczenia

  • Zaimportuj pandas (zgodnie z konwencją użyj aliasu pd).
  • Spłaszcz tweety z data_science_json za pomocą flatten_tweets() i zapisz wynik w zmiennej tweets.
  • Utwórz DataFrame z tweets przy użyciu pd.DataFrame().
  • Wyświetl tekst pierwszych 5 tweetów.

Interaktywne ćwiczenie praktyczne

Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.

# Import pandas
import ____ as ____

# Flatten the tweets and store in `tweets`
tweets = ____(____)

# Create a DataFrame from `tweets`
ds_tweets = ____(____)

# Print out the first 5 tweets from this dataset
print(ds_tweets[____].values[0:5])
Edytuj i uruchom kod