or
Это упражнение является частью курса
Изучите структуру HTML. Сначала мы объясним, почему веб-скрапинг — ценный инструмент в арсенале специалиста по данным, а затем рассмотрим основы HTML. В завершение главы вы познакомитесь с нотацией XPath, которая используется для навигации по элементам HTML-кода.
Используйте синтаксис XPath для работы с селекторами scrapy. Оба этих инструмента помогут вам шаг за шагом овладеть навыком скрапинга HTML-документов.
Освойте синтаксис CSS-локаторов и научитесь объединять их с XPath в цепочки вызовов. Кроме того, в этой главе мы познакомим вас с объектами Response, которые работают подобно селекторам, но предоставляют дополнительные возможности для организации скрапинга сразу на нескольких сайтах.
Научитесь создавать веб-краулеры с помощью scrapy. Эти пауки будут обходить несколько страниц, переходить по ссылкам и автоматически извлекать данные с каждой из них — применяя всё, что вы изучили в предыдущих главах.
Текущее упражнение