开始使用免费开始使用

顶层文本

本练习要求您分别编写一个 XPath 和一个 CSS 定位器字符串,用来指向特定段落 p 元素的文本。HTML 中该 p 元素通过其 id 属性被唯一标识,为 "p3"。基于这一信息,您应能构造出所需的字符串;另外,我们已将包含该链接所在 HTML 的字符串预加载到变量 html 中,若您想先浏览可以查看它。

在本练习中,您只需选择元素内部的文本,且不包含该元素的后代节点文本。我们已为您创建函数 print_results,用于比较您的字符串所指向的元素。

本练习是课程的一部分

Python Web 爬取

查看课程

练习说明

  • 将变量 xpath 设为一个 XPath 字符串,指向 id 等于 p3 的段落 p 元素内部的文本,且不包含p 元素后代节点的文本。
  • 将变量 css_locator 设为一个 CSS 定位器字符串,指向同样的文本。

交互式实操练习

通过完成这段示例代码来试试这个练习。

# Create an XPath string to the desired text.
xpath = ____

# Create a CSS Locator string to the desired text.
css_locator = ____

# Print the text from our selections
print_results( xpath, css_locator )
编辑并运行代码