Coba nama lain
Anda masih mengerjakan analisis sentimen Twitter. Sekarang Anda menganalisis beberapa hal yang menarik perhatian. Anda melihat ada alamat email yang disisipkan di beberapa tweet. Kini Anda penasaran ingin mengetahui nama mana yang paling umum.
Anda ingin mengekstrak bagian pertama dari email. Misalnya, jika Anda memiliki email [email protected], Anda hanya tertarik pada marysmith90.
Anda perlu mencocokkan keseluruhan ekspresi. Dengan begitu, Anda memastikan hanya mengekstrak nama yang ada di email. Selain itu, Anda hanya tertarik pada nama yang berisi huruf besar (mis. A, B, Z) atau huruf kecil (mis. a, d, z) dan angka.
Daftar sentiment_analysis yang berisi teks dari tiga tweet serta modul re telah dimuat dalam sesi Anda. Anda dapat menggunakan print() untuk melihatnya di IPython Shell.
Latihan ini merupakan bagian dari kursus
Regular Expressions in Python
Instruksi latihan
- Lengkapi regex untuk mencocokkan email dengan hanya menangkap bagian nama. Bagian nama muncul sebelum
@. - Temukan semua kecocokan regex pada setiap elemen
sentiment_analysis. Tetapkan ke variabelemail_matched. - Lengkapi metode
.format()untuk mencetak hasil yang ditangkap pada setiap elemensentiment_analysis.
Latihan interaktif langsung praktik
Cobalah latihan ini dengan melengkapi kode contoh ini.
# Write a regex that matches email
regex_email = r"___[____]____\S+"
for tweet in sentiment_analysis:
# Find all matches of regex in each tweet
email_matched = re.____(____, ____)
# Complete the format method to print the results
print("Lists of users found in this tweet: {}".format(____))