НачатьНачать бесплатно

Раскрываем секрет с помощью Response

Мы заранее загрузили объект Response с именем response, содержащий данные с секретного сайта. Ваша задача — узнать URL и заголовок этого сайта с помощью переменной response. Как получить URL, вы узнали на прошлом уроке. Чтобы найти заголовок сайта, важно знать следующее:

  • Заголовок — это текст элемента title.
  • Элемент title является дочерним по отношению к элементу head, который, в свою очередь, является дочерним по отношению к корневому элементу html.

Обратите внимание: корневой элемент html содержит только один дочерний элемент head, а элемент head — только один дочерний элемент title.

Это упражнение является частью курса

Веб-скрапинг на Python

Посмотреть курс

Инструкции к упражнению

  • Присвойте переменной this_url URL, использованный для загрузки переменной response.
  • Присвойте переменной this_title заголовок сайта, загруженного в переменную response. Поскольку нам нужен текст единственного выбранного элемента, используйте метод extract_first() для его извлечения.
  • Независимо от того, используете ли вы xpath или css, убедитесь, что вы выбираете именно текст внутри элемента title, а не сам элемент.

Интерактивное практическое упражнение

Попробуйте выполнить это упражнение, дополнив этот пример кода.

# Get the URL to the website loaded in response
this_url = ____

# Get the title of the website loaded in response
this_title = response.____.extract_first()

# Print out our findings
print_url_title( this_url, this_title )
Редактировать и запускать код