Mulai sekarangMulai gratis

Coba nama lain

Anda masih mengerjakan analisis sentimen Twitter. Sekarang Anda menganalisis beberapa hal yang menarik perhatian. Anda melihat ada alamat email yang disisipkan di beberapa tweet. Kini Anda penasaran ingin mengetahui nama mana yang paling umum.

Anda ingin mengekstrak bagian pertama dari email. Misalnya, jika Anda memiliki email [email protected], Anda hanya tertarik pada marysmith90. Anda perlu mencocokkan keseluruhan ekspresi. Dengan begitu, Anda memastikan hanya mengekstrak nama yang ada di email. Selain itu, Anda hanya tertarik pada nama yang berisi huruf besar (mis. A, B, Z) atau huruf kecil (mis. a, d, z) dan angka.

Daftar sentiment_analysis yang berisi teks dari tiga tweet serta modul re telah dimuat dalam sesi Anda. Anda dapat menggunakan print() untuk melihatnya di IPython Shell.

Latihan ini merupakan bagian dari kursus

Regular Expressions in Python

Lihat Kursus

Instruksi latihan

  • Lengkapi regex untuk mencocokkan email dengan hanya menangkap bagian nama. Bagian nama muncul sebelum @.
  • Temukan semua kecocokan regex pada setiap elemen sentiment_analysis. Tetapkan ke variabel email_matched.
  • Lengkapi metode .format() untuk mencetak hasil yang ditangkap pada setiap elemen sentiment_analysis.

Latihan interaktif langsung praktik

Cobalah latihan ini dengan melengkapi kode contoh ini.

# Write a regex that matches email
regex_email = r"___[____]____\S+"

for tweet in sentiment_analysis:
    # Find all matches of regex in each tweet
    email_matched = re.____(____, ____)

    # Complete the format method to print the results
    print("Lists of users found in this tweet: {}".format(____))
Edit dan Jalankan Kode