最上層文字
在這個練習中,你要撰寫 XPath 與 CSS Locator 字串,指向特定段落元素 p 的文字。HTML 中的這個 p 元素由其 id 屬性唯一識別,值為 "p3"。有了這個小線索,你應該能建立所需的字串。不過我們也已經將變數 html 預先載入為一段包含此連結所屬 HTML 的字串,若你想先瀏覽可加以參考。
在本練習中,你只會選取該元素內部的文字,這些文字「不包含」該元素日後子孫層級中的文字。我們已為你建立 print_results 函式,方便你比較你的字串實際指向哪些元素。
本練習屬於課程
Python 網頁爬蟲
練習說明
- 將變數
xpath指派為一個 XPath 字串,指向id等於p3的段落元素p之「元素內部的文字」,且「不包含」此p元素未來子孫層級的文字。 - 將變數
css_locator指派為一個 CSS Locator 字串,指向相同的文字。
動手互動練習
試著完成這個範例程式碼,體驗一下這個練習。
# Create an XPath string to the desired text.
xpath = ____
# Create a CSS Locator string to the desired text.
css_locator = ____
# Print the text from our selections
print_results( xpath, css_locator )