เปิดเผยด้วย Response
เราได้โหลด object Response ชื่อ response ที่มีเนื้อหาจากเว็บไซต์ลับไว้ให้แล้ว หน้าที่ของคุณคือค้นหา URL และชื่อของเว็บไซต์นั้นโดยใช้ตัวแปร response คุณได้เรียนวิธีค้นหา URL ไปแล้วในบทเรียนที่ผ่านมา สำหรับการค้นหาชื่อเว็บไซต์ มีสิ่งที่ต้องรู้ดังนี้:
- ชื่อเว็บไซต์คือ ข้อความ จาก element
title - element
titleเป็น child ของ elementheadซึ่งเป็น child ของ root elementhtml
หมายเหตุ: root element html มี child element head เพียงตัวเดียว และ element head มี child element title เพียงตัวเดียวเช่นกัน
แบบฝึกหัดนี้เป็นส่วนหนึ่งของหลักสูตร
Web Scraping ด้วย Python
คำแนะนำการฝึกหัด
- กำหนดให้ตัวแปร
this_urlเก็บ URL ที่ใช้โหลดตัวแปรresponse - กำหนดให้ตัวแปร
this_titleเก็บชื่อเว็บไซต์ที่ใช้โหลดตัวแปรresponseเนื่องจากต้องการเฉพาะข้อความจาก element เดียวที่เลือก ให้ใช้เมธอดextract_first()เพื่อดึงข้อความนั้น - ไม่ว่าจะใช้
xpathหรือcssให้แน่ใจว่ากำลังเลือก ข้อความ ภายใน element title ไม่ใช่แค่ตัว element title เอง
แบบฝึกหัดเชิงโต้ตอบแบบลงมือทำ
ลองทำแบบฝึกหัดนี้โดยเติมโค้ดตัวอย่างนี้ให้สมบูรณ์
# Get the URL to the website loaded in response
this_url = ____
# Get the title of the website loaded in response
this_title = response.____.extract_first()
# Print out our findings
print_url_title( this_url, this_title )