Bắt đầu ngayBắt đầu miễn phí

Tuyệt quá!

Bạn vẫn đang làm việc trên dự án phân tích cảm xúc Twitter. Trước tiên, bạn muốn xác định các tweet tích cực về phim và buổi hòa nhạc.

Bạn dự định tìm tất cả câu chứa các từ love, like, hoặc enjoy và bắt (capture) từ đó. Bạn sẽ giới hạn các tweet bằng cách tập trung vào những tweet có chứa từ movie hoặc concert bằng cách giữ từ này trong một nhóm khác. Bạn cũng sẽ lưu tên bộ phim hoặc buổi hòa nhạc.

Ví dụ, nếu bạn có câu: I love the movie Avengers. Bạn khớp và bắt love. Bạn cần khớp và bắt movie. Sau đó, bạn khớp và bắt mọi thứ cho đến dấu chấm.

Danh sách sentiment_analysis chứa văn bản của ba tweet và mô-đun re đã được nạp trong phiên của bạn. Bạn có thể dùng print() để xem dữ liệu trong IPython Shell.

Bài tập này là một phần của khóa học

Regular Expressions in Python

Xem khóa học

Hướng dẫn bài tập

  • Hoàn chỉnh biểu thức chính quy để bắt các từ love hoặc like hoặc enjoy. Khớp và bắt các từ movie hoặc concert. Khớp và bắt mọi thứ xuất hiện cho đến dấu ..
  • Tìm tất cả kết quả khớp của regex trong mỗi phần tử của sentiment_analysis. Gán chúng vào positive_matches.
  • Hoàn chỉnh phương thức .format() để in ra các kết quả trong positive_matches cho từng phần tử trong sentiment_analysis.

Bài tập tương tác thực hành trực tiếp

Hãy thử làm bài tập này bằng cách hoàn thành đoạn mã mẫu này.

# Write a regex that matches sentences with the optional words
regex_positive = r"____.+?____\s____\."

for tweet in sentiment_analysis:
	# Find all matches of regex in tweet
    positive_matches = re.____(____, ____)
    
    # Complete format to print out the results
    print("Positive comments found ____".format(____))
Chỉnh sửa và Chạy Mã