Essayez un autre nom
Vous travaillez toujours sur votre analyse de sentiment de Twitter. Vous examinez maintenant certains éléments qui ont attiré votre attention. Vous avez remarqué que des adresses courriel sont insérées dans certains tweets. Vous êtes maintenant curieux de savoir quel est le prénom le plus courant.
Vous voulez extraire la première partie de l'adresse courriel. Par exemple, si vous avez le courriel [email protected], vous vous intéressez seulement à marysmith90.
Vous devez faire correspondre l'expression entière. Ainsi, vous vous assurez d'extraire uniquement des noms présents dans des adresses courriel. De plus, vous ne vous intéressez qu'aux noms contenant des lettres majuscules (p. ex. A, B, Z) ou minuscules (p. ex. a, d, z) et des chiffres.
La liste sentiment_analysis contenant le texte de trois tweets ainsi que le module re ont été chargés dans votre session. Vous pouvez utiliser print() pour l'afficher dans l'IPython Shell.
Cette activité fait partie du cours
Expressions régulières en Python
Instructions de l’exercice
- Complétez la regex pour faire correspondre l'adresse courriel en ne capturant que la partie du nom. La partie du nom apparaît avant le
@. - Trouvez toutes les correspondances de la regex dans chaque élément de
sentiment_analysis. Assignez-les à la variableemail_matched. - Complétez la méthode
.format()pour afficher les résultats capturés dans chaque élément desentiment_analysis.
Exercice interactif pratique
Essayez cet exercice en complétant ce code d’exemple.
# Write a regex that matches email
regex_email = r"___[____]____\S+"
for tweet in sentiment_analysis:
# Find all matches of regex in each tweet
email_matched = re.____(____, ____)
# Complete the format method to print the results
print("Lists of users found in this tweet: {}".format(____))