顶层文本
本练习要求您分别编写一个 XPath 和一个 CSS 定位器字符串,用来指向特定段落 p 元素的文本。HTML 中该 p 元素通过其 id 属性被唯一标识,为 "p3"。基于这一信息,您应能构造出所需的字符串;另外,我们已将包含该链接所在 HTML 的字符串预加载到变量 html 中,若您想先浏览可以查看它。
在本练习中,您只需选择元素内部的文本,且不包含该元素的后代节点文本。我们已为您创建函数 print_results,用于比较您的字符串所指向的元素。
本练习是课程的一部分
Python Web 爬取
练习说明
- 将变量
xpath设为一个 XPath 字符串,指向id等于p3的段落p元素内部的文本,且不包含该p元素后代节点的文本。 - 将变量
css_locator设为一个 CSS 定位器字符串,指向同样的文本。
交互式实操练习
通过完成这段示例代码来试试这个练习。
# Create an XPath string to the desired text.
xpath = ____
# Create a CSS Locator string to the desired text.
css_locator = ____
# Print the text from our selections
print_results( xpath, css_locator )