Kom igångKom igång gratis

Hitta nyckelord

Att räkna förekomster av kända nyckelord är ett av de första sätten att analysera textdata i ett Twitter-dataset. I det här datasetet ska du räkna hur många gånger specifika hashtags förekommer i en samling tweets om data science. För att göra det använder du strängmetoderna i pandas Series-objektet.

pandas och numpy har importerats som pd respektive np. En mer komplett version av flatten_tweets och data_science_json har också laddats in åt dig.

Den här övningen är en del av kursen

Analys av sociala medier i Python

Visa kurs

Övningsinstruktioner

  • Platta ut tweets med flatten_tweets() och lagra dem i flat_tweets.
  • Konvertera tweets till en DataFrame med pandas DataFrame-konstruktorn.
  • Hitta omnämnanden av #python i 'text', utan hänsyn till skiftläge.
  • Skriv ut andelen tweets som nämner #python genom att summera python med np.sum() och dividera med det totala antalet tweets.

Interaktiv övning med praktiskt arbete

Testa den här övningen genom att slutföra den här exempelkoden.

# Flatten the tweets and store them
____ = ____(____)

# Convert to DataFrame
ds_tweets = ____.____(____)

# Find mentions of #python in 'text'
python = ____[____].____.____(____, ____)

# Print proportion of tweets mentioning #python
print("Proportion of #python tweets:", ____ / ____)
Redigera och kör kod