시작하기무료로 시작하기

너무 좋아요!

여러분은 계속해서 Twitter 감성 분석 프로젝트를 진행하고 있어요. 먼저, 영화와 콘서트에 대해 긍정적인 트윗을 식별하려고 합니다.

문장에 love, like, enjoy 중 하나가 들어 있으면 그 단어를 캡처하려고 해요. 또한 movie 또는 concert라는 단어가 들어 있는 트윗에 집중해 그 단어를 다른 그룹으로 캡처하고, 이어서 영화나 콘서트 이름도 저장할 거예요.

예를 들어, 문장이 I love the movie Avengers. 라면 love를 매치하고 캡처합니다. 또한 movie를 매치하고 캡처해야 해요. 그다음 점(.)이 나오기 전까지의 모든 내용을 매치하고 캡처합니다.

세 개의 트윗 텍스트가 담긴 리스트 sentiment_analysisre 모듈이 세션에 로드되어 있어요. IPython 셸에서 print()로 데이터를 확인할 수 있어요.

이 연습은 강의의 일부입니다

Python에서의 정규 표현식

강의 보기

연습 안내

  • 정규 표현식을 완성해 love 또는 like 또는 enjoy를 캡처하세요. 이어서 movie 또는 concert를 매치하고 캡처하세요. 그다음 .이 나오기 전까지 등장하는 모든 내용을 매치하고 캡처하세요.
  • sentiment_analysis의 각 요소에서 이 정규식을 사용해 모든 일치를 찾고, 결과를 positive_matches에 할당하세요.
  • sentiment_analysis의 각 요소에 대해 positive_matches에 담긴 결과를 출력하도록 .format() 메서드를 완성하세요.

실습형 인터랙티브 연습

이 예제를 이 샘플 코드를 완성하여 풀어보세요.

# Write a regex that matches sentences with the optional words
regex_positive = r"____.+?____\s____\."

for tweet in sentiment_analysis:
	# Find all matches of regex in tweet
    positive_matches = re.____(____, ____)
    
    # Complete format to print out the results
    print("Positive comments found ____".format(____))
코드 편집 및 실행