Раскрываем секрет с помощью Response
Мы заранее загрузили объект Response с именем response, содержащий данные с секретного сайта. Ваша задача — узнать URL и заголовок этого сайта с помощью переменной response. Как получить URL, вы узнали на прошлом уроке. Чтобы найти заголовок сайта, важно знать следующее:
- Заголовок — это текст элемента
title. - Элемент
titleявляется дочерним по отношению к элементуhead, который, в свою очередь, является дочерним по отношению к корневому элементуhtml.
Обратите внимание: корневой элемент html содержит только один дочерний элемент head, а элемент head — только один дочерний элемент title.
Это упражнение является частью курса
Веб-скрапинг на Python
Инструкции к упражнению
- Присвойте переменной
this_urlURL, использованный для загрузки переменнойresponse. - Присвойте переменной
this_titleзаголовок сайта, загруженного в переменнуюresponse. Поскольку нам нужен текст единственного выбранного элемента, используйте методextract_first()для его извлечения. - Независимо от того, используете ли вы
xpathилиcss, убедитесь, что вы выбираете именно текст внутри элементаtitle, а не сам элемент.
Интерактивное практическое упражнение
Попробуйте выполнить это упражнение, дополнив этот пример кода.
# Get the URL to the website loaded in response
this_url = ____
# Get the title of the website loaded in response
this_title = response.____.extract_first()
# Print out our findings
print_url_title( this_url, this_title )