НачатьНачать бесплатно

Атрибут `href` на практике

В предыдущем упражнении вы создали строку CSS-локатора для выбора дочерних гиперссылок (элементов a) всех элементов div, принадлежащих классу "course-block". Здесь мы уже создали SelectorList с именем course_as, выбрав эти дочерние гиперссылки.

Теперь вам нужно заполнить пропуск ниже, чтобы извлечь значения атрибута href из этих элементов. Это ещё один пример цепочки вызовов, как мы видели в предыдущем упражнении.

Главная идея здесь в том, что можно объединять вызовы методов css и xpath в цепочку! Чтобы помочь вам двигаться в правильном направлении, мы приводим решение с использованием цепочки из ещё одного вызова метода css.

Это упражнение является частью курса

Веб-скрапинг на Python

Посмотреть курс

Инструкции к упражнению

  • Создайте объект Selector с именем sel, используя строку html в качестве текстового входного значения.
  • Присвойте переменной hrefs_from_xpath значения атрибута href из элементов в course_as. Ваше решение должно совпадать с hrefs_from_css!

Интерактивное практическое упражнение

Попробуйте выполнить это упражнение, дополнив этот пример кода.

from scrapy import Selector

# Create a selector object from a secret website
sel = Selector( ____ )

# Select all hyperlinks of div elements belonging to class "course-block"
course_as = sel.css( 'div.course-block > a' )

# Selecting all href attributes chaining with css
hrefs_from_css = course_as.css( '::attr(href)' )

# Selecting all href attributes chaining with xpath
hrefs_from_xpath = course_as.xpath( ____ )
Редактировать и запускать код