Essayez un autre nom
Vous travaillez toujours sur votre analyse de sentiment de Twitter. Vous examinez maintenant quelques éléments qui ont attiré votre attention. Vous avez remarqué que des adresses e‑mail sont insérées dans certains tweets. Vous êtes à présent curieux de savoir quel est le prénom le plus fréquent.
Vous souhaitez extraire la première partie de l’e‑mail. Par exemple, si vous avez l’adresse [email protected], seule la partie marysmith90 vous intéresse.
Vous devez faire correspondre l’expression entière, afin d’extraire uniquement des noms présents dans des e‑mails. De plus, vous ne vous intéressez qu’aux noms contenant des lettres majuscules (p. ex. A, B, Z) ou minuscules (p. ex. a, d, z) et des chiffres.
La liste sentiment_analysis contenant le texte de trois tweets ainsi que le module re ont été chargés dans votre session. Vous pouvez utiliser print() pour les afficher dans l’IPython Shell.
Cet exercice fait partie du cours
<cours>Expressions rationnelles en Python</cours>Instructions de l’exercice
- Complétez la regex pour faire correspondre l’adresse e‑mail en ne capturant que la partie nom. La partie nom apparaît avant le
@. - Trouvez toutes les correspondances de la regex dans chaque élément de
sentiment_analysis. Affectez-les à la variableemail_matched. - Complétez la méthode
.format()pour imprimer les résultats capturés dans chaque élément desentiment_analysis.
Exercice interactif pratique
Essayez cet exercice en complétant ce code d’exemple.
# Write a regex that matches email
regex_email = r"___[____]____\S+"
for tweet in sentiment_analysis:
# Find all matches of regex in each tweet
email_matched = re.____(____, ____)
# Complete the format method to print the results
print("Lists of users found in this tweet: {}".format(____))