Hitta nyckelord
Att räkna förekomster av kända nyckelord är ett av de första sätten att analysera textdata i ett Twitter-dataset. I det här datasetet ska du räkna hur många gånger specifika hashtags förekommer i en samling tweets om data science. För att göra det använder du strängmetoderna i pandas Series-objektet.
pandas och numpy har importerats som pd respektive np. En mer komplett version av flatten_tweets och data_science_json har också laddats in åt dig.
Den här övningen är en del av kursen
Analys av sociala medier i Python
Övningsinstruktioner
- Platta ut tweets med
flatten_tweets()och lagra dem iflat_tweets. - Konvertera tweets till en DataFrame med pandas DataFrame-konstruktorn.
- Hitta omnämnanden av
#pythoni'text', utan hänsyn till skiftläge. - Skriv ut andelen tweets som nämner
#pythongenom att summerapythonmednp.sum()och dividera med det totala antalet tweets.
Interaktiv övning med praktiskt arbete
Testa den här övningen genom att slutföra den här exempelkoden.
# Flatten the tweets and store them
____ = ____(____)
# Convert to DataFrame
ds_tweets = ____.____(____)
# Find mentions of #python in 'text'
python = ____[____].____.____(____, ____)
# Print proportion of tweets mentioning #python
print("Proportion of #python tweets:", ____ / ____)