LoslegenKostenlos starten

Love it!

Du arbeitest weiterhin am Twitter-Sentiment-Analyseprojekt. Zuerst möchtest du positive Tweets über Filme und Konzerte identifizieren.

Du planst, alle Sätze zu finden, die die Wörter love, like oder enjoy enthalten, und dieses Wort zu erfassen. Du beschränkst die Tweets, indem du dich auf diejenigen konzentrierst, die die Wörter movie oder concert enthalten, und behältst dieses Wort in einer weiteren Gruppe. Außerdem speicherst du den Namen des Films oder Konzerts.

Wenn du zum Beispiel den Satz hast: I love the movie Avengers. Dann matchst und erfasst du love. Du musst movie matchen und erfassen. Danach matchst und erfasst du alles bis zum Punkt.

Die Liste sentiment_analysis mit dem Text von drei Tweets sowie das Modul re sind in deiner Session geladen. Du kannst print() verwenden, um dir die Daten in der IPython Shell anzusehen.

Diese Übung ist Teil des Kurses

<Kurs>Reguläre Ausdrücke in Python</Kurs>
Kurs ansehen

Übungsanweisungen

  • Vervollständige den regulären Ausdruck, um die Wörter love oder like oder enjoy zu erfassen. Matche und erfasse die Wörter movie oder concert. Matche und erfasse alles, was bis zum . erscheint.
  • Finde alle Treffer des Regex in jedem Element von sentiment_analysis. Weise sie positive_matches zu.
  • Vervollständige die .format()-Methode, um die in positive_matches enthaltenen Ergebnisse für jedes Element in sentiment_analysis auszugeben.

Interaktive praktische Übung

Versuche dich an dieser Übung, indem du diesen Beispielcode vervollständigst.

# Write a regex that matches sentences with the optional words
regex_positive = r"____.+?____\s____\."

for tweet in sentiment_analysis:
	# Find all matches of regex in tweet
    positive_matches = re.____(____, ____)
    
    # Complete format to print out the results
    print("Positive comments found ____".format(____))
Code bearbeiten und ausführen