ПочатиПочніть безкоштовно

Розкриття через Response

Ми попередньо завантажили об'єкт Response з назвою response умістом із секретного вебсайту. Ваше завдання — з'ясувати URL і заголовок цього сайту, використовуючи змінну response. На попередньому уроці ви дізналися, як знаходити URL. Щоб знайти заголовок сайту, вам потрібно знати таке:

  • Заголовок — це текст з елемента title
  • Елемент title є нащадком елемента head, який, своєю чергою, є нащадком кореневого елемента html.

Зверніть увагу: кореневий елемент html має лише одного нащадка head, а елемент head має лише одного нащадка title.

Ця вправа є частиною курсу

Вебскрапінг у Python

Переглянути курс

Інструкції до вправи

  • Присвойте змінній this_url URL, за яким було завантажено змінну response.
  • Присвойте змінній this_title заголовок вебсайту, з якого було завантажено змінну response. Оскільки нам потрібен лише текст одного вибраного елемента, використайте метод extract_first() для отримання тексту.
  • Незалежно від того, використовуєте ви xpath чи css, переконайтеся, що вибираєте саме текст усередині елемента title, а не сам елемент.

Інтерактивна практична вправа

Спробуйте виконати цю вправу, доповнивши цей зразок коду.

# Get the URL to the website loaded in response
this_url = ____

# Get the title of the website loaded in response
this_title = response.____.extract_first()

# Print out our findings
print_url_title( this_url, this_title )
Редагувати та запускати код