Атрибут `href` на практике
В предыдущем упражнении вы создали строку CSS-локатора для выбора дочерних гиперссылок (элементов a) всех элементов div, принадлежащих классу "course-block". Здесь мы уже создали SelectorList с именем course_as, выбрав эти дочерние гиперссылки.
Теперь вам нужно заполнить пропуск ниже, чтобы извлечь значения атрибута href из этих элементов. Это ещё один пример цепочки вызовов, как мы видели в предыдущем упражнении.
Главная идея здесь в том, что можно объединять вызовы методов css и xpath в цепочку! Чтобы помочь вам двигаться в правильном направлении, мы приводим решение с использованием цепочки из ещё одного вызова метода css.
Это упражнение является частью курса
Веб-скрапинг на Python
Инструкции к упражнению
- Создайте объект
Selectorс именемsel, используя строкуhtmlв качестве текстового входного значения. - Присвойте переменной
hrefs_from_xpathзначения атрибутаhrefиз элементов вcourse_as. Ваше решение должно совпадать сhrefs_from_css!
Интерактивное практическое упражнение
Попробуйте выполнить это упражнение, дополнив этот пример кода.
from scrapy import Selector
# Create a selector object from a secret website
sel = Selector( ____ )
# Select all hyperlinks of div elements belonging to class "course-block"
course_as = sel.css( 'div.course-block > a' )
# Selecting all href attributes chaining with css
hrefs_from_css = course_as.css( '::attr(href)' )
# Selecting all href attributes chaining with xpath
hrefs_from_xpath = course_as.xpath( ____ )