Response로 밝혀내기
비밀 웹사이트의 콘텐츠로 채워진 Response 객체 response가 미리 로드되어 있어요. 이 response 변수를 사용해 웹사이트의 URL과 제목을 알아내세요. URL 찾는 방법은 지난 레슨에서 배웠죠. 웹사이트 제목을 찾으려면 다음을 기억하세요:
- 제목은
title요소의 텍스트예요. title요소는head요소의 자식이고,head요소는 루트 요소인html의 자식이에요.
참고: 루트 요소 html에는 자식 head 요소가 하나만 있고, head 요소에도 자식 title 요소가 하나만 있어요.
이 연습은 강의의 일부입니다
Python으로 하는 웹 스크레이핑
연습 안내
- 변수
this_url에response변수를 불러오는 데 사용된 URL을 할당하세요. - 변수
this_title에response변수를 불러오는 데 사용된 웹사이트의 제목을 할당하세요. 단일 요소에서 텍스트만 가져오므로extract_first()메서드를 사용해 텍스트를 추출하세요. xpath를 쓰든css를 쓰든, title 요소 자체가 아니라 title 요소 안의 텍스트를 선택하도록 하세요.
실습형 인터랙티브 연습
이 예제를 이 샘플 코드를 완성하여 풀어보세요.
# Get the URL to the website loaded in response
this_url = ____
# Get the title of the website loaded in response
this_title = response.____.extract_first()
# Print out our findings
print_url_title( this_url, this_title )