Probier einen anderen Namen aus
Du arbeitest weiterhin an deiner Twitter-Stimmungsanalyse. Jetzt schaust du dir ein paar Dinge an, die dir aufgefallen sind. Dir ist aufgefallen, dass in manchen Tweets E-Mail-Adressen vorkommen. Jetzt bist du neugierig, welcher Name am häufigsten ist.
Du möchtest den ersten Teil der E-Mail extrahieren. Z. B. wenn du die E-Mail [email protected] hast, interessiert dich nur marysmith90.
Du musst den gesamten Ausdruck matchen. So stellst du sicher, dass du nur Namen extrahierst, die in E-Mails vorkommen. Außerdem interessierst du dich nur für Namen, die Groß- (z. B. A, B, Z) oder Kleinbuchstaben (z. B. a, d, z) und Zahlen enthalten.
Die Liste sentiment_analysis mit dem Text von drei Tweets sowie das Modul re wurden in deiner Session geladen. Du kannst print() verwenden, um sie dir in der IPython-Shell anzusehen.
Diese Übung ist Teil des Kurses
<Kurs>Reguläre Ausdrücke in Python</Kurs>Übungsanweisungen
- Vervollständige den Regex so, dass die E-Mail gematcht wird und nur der Namensanteil erfasst wird. Der Namensanteil steht vor dem
@. - Finde alle Treffer des Regex in jedem Element von
sentiment_analysis. Weisen sie der Variableemail_matchedzu. - Vervollständige die
.format()-Methode, um die in jedem Element vonsentiment_analysiserfassten Ergebnisse auszugeben.
Interaktive praktische Übung
Versuche dich an dieser Übung, indem du diesen Beispielcode vervollständigst.
# Write a regex that matches email
regex_email = r"___[____]____\S+"
for tweet in sentiment_analysis:
# Find all matches of regex in each tweet
email_matched = re.____(____, ____)
# Complete the format method to print the results
print("Lists of users found in this tweet: {}".format(____))