LoslegenKostenlos starten

Probier einen anderen Namen aus

Du arbeitest weiterhin an deiner Twitter-Stimmungsanalyse. Jetzt schaust du dir ein paar Dinge an, die dir aufgefallen sind. Dir ist aufgefallen, dass in manchen Tweets E-Mail-Adressen vorkommen. Jetzt bist du neugierig, welcher Name am häufigsten ist.

Du möchtest den ersten Teil der E-Mail extrahieren. Z. B. wenn du die E-Mail [email protected] hast, interessiert dich nur marysmith90. Du musst den gesamten Ausdruck matchen. So stellst du sicher, dass du nur Namen extrahierst, die in E-Mails vorkommen. Außerdem interessierst du dich nur für Namen, die Groß- (z. B. A, B, Z) oder Kleinbuchstaben (z. B. a, d, z) und Zahlen enthalten.

Die Liste sentiment_analysis mit dem Text von drei Tweets sowie das Modul re wurden in deiner Session geladen. Du kannst print() verwenden, um sie dir in der IPython-Shell anzusehen.

Diese Übung ist Teil des Kurses

<Kurs>Reguläre Ausdrücke in Python</Kurs>
Kurs ansehen

Übungsanweisungen

  • Vervollständige den Regex so, dass die E-Mail gematcht wird und nur der Namensanteil erfasst wird. Der Namensanteil steht vor dem @.
  • Finde alle Treffer des Regex in jedem Element von sentiment_analysis. Weisen sie der Variable email_matched zu.
  • Vervollständige die .format()-Methode, um die in jedem Element von sentiment_analysis erfassten Ergebnisse auszugeben.

Interaktive praktische Übung

Versuche dich an dieser Übung, indem du diesen Beispielcode vervollständigst.

# Write a regex that matches email
regex_email = r"___[____]____\S+"

for tweet in sentiment_analysis:
    # Find all matches of regex in each tweet
    email_matched = re.____(____, ____)

    # Complete the format method to print the results
    print("Lists of users found in this tweet: {}".format(____))
Code bearbeiten und ausführen