Hledáme text na všech možných místech
Jak už víš, relevantní text tweetu se nemusí nacházet jen v hlavním poli text. Může být také v extended_tweet, retweeted_status nebo quoted_status. Musíme zkontrolovat všechna tato pole, abychom zachytili veškerý relevantní text. Protože to budeme dělat často, vytvoříme si na to funkci.
První dva řádky kontrolují, zda hlavní pole text nebo extended_tweet obsahují hledaný text. Zbytek doplníš ty.
Toto cvičení je součástí kurzu
Analýza dat ze sociálních sítí v Pythonu
Pokyny k cvičení
Dokonči funkci check_word_in_tweet podle následujících kroků:
- Zkontroluj, zda pole
quoted_status-textobsahuje hledané slovo. - Zkontroluj, zda pole
quoted_status-extended_tweet-full_textobsahuje hledané slovo. - Zkontroluj, zda pole
retweeted_status-textobsahuje hledané slovo. - Zkontroluj, zda pole
retweeted_status-extended_tweet-full_textobsahuje hledané slovo.
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
def check_word_in_tweet(word, data):
"""Checks if a word is in a Twitter dataset's text.
Checks text and extended tweet (140+ character tweets) for tweets,
retweets and quoted tweets.
Returns a logical pandas Series.
"""
contains_column = data['text'].str.contains(word, case = False)
contains_column |= data['extended_tweet-full_text'].str.contains(word, case = False)
contains_column |= data[____].str.contains(word, case = False)
contains_column |= data[____].____.____(____, case = False)
contains_column |= data[____].____.____(____, ____)
contains_column |= ____[____].____.____(____, ____)
return contains_column