请选择下列哪一项是错误的。
本练习是课程的一部分
通过我们的互动练习之一,将理论转化为实践
学习 HTML 的结构。我们先说明为什么网页爬取是您数据科学工具箱中的有价值补充,然后介绍 HTML 的基础知识。章节最后将简要介绍用于在 HTML 代码中导航元素的 XPath 表示法。
当前练习
利用 XPath 语法探索 scrapy 选择器。这两个概念将帮助您逐步掌握抓取 HTML 文档。
学习 CSS 定位器语法,并尝试将 CSS 定位器与 XPath 进行链式组合。我们还将介绍 Response 对象。它的行为与 Selector 相似,但提供了额外工具,帮助我们将爬取扩展到多个网站。
学习使用 scrapy 创建网络爬虫。这些 scrapy 爬虫会跨多页在网页间跳转,按照前几章所学的方法自动跟随链接抓取每一页。