Розкриття через Response
Ми попередньо завантажили об'єкт Response з назвою response умістом із секретного вебсайту. Ваше завдання — з'ясувати URL і заголовок цього сайту, використовуючи змінну response. На попередньому уроці ви дізналися, як знаходити URL. Щоб знайти заголовок сайту, вам потрібно знати таке:
- Заголовок — це текст з елемента
title - Елемент
titleє нащадком елементаhead, який, своєю чергою, є нащадком кореневого елементаhtml.
Зверніть увагу: кореневий елемент html має лише одного нащадка head, а елемент head має лише одного нащадка title.
Ця вправа є частиною курсу
Вебскрапінг у Python
Інструкції до вправи
- Присвойте змінній
this_urlURL, за яким було завантажено зміннуresponse. - Присвойте змінній
this_titleзаголовок вебсайту, з якого було завантажено зміннуresponse. Оскільки нам потрібен лише текст одного вибраного елемента, використайте методextract_first()для отримання тексту. - Незалежно від того, використовуєте ви
xpathчиcss, переконайтеся, що вибираєте саме текст усередині елемента title, а не сам елемент.
Інтерактивна практична вправа
Спробуйте виконати цю вправу, доповнивши цей зразок коду.
# Get the URL to the website loaded in response
this_url = ____
# Get the title of the website loaded in response
this_title = response.____.extract_first()
# Print out our findings
print_url_title( this_url, this_title )