Bắt đầu ngayBắt đầu miễn phí

Bật mí qua Response

Chúng tôi đã nạp sẵn một đối tượng Response, tên là response, với nội dung từ một trang web bí mật. Nhiệm vụ của bạn là tìm ra URL và tiêu đề của trang web bằng biến response. Bạn đã học cách tìm URL ở bài trước. Để tìm tiêu đề trang, bạn cần biết rằng:

  • Tiêu đề là văn bản của phần tử title
  • Phần tử title là con của phần tử head, và head là con của phần tử gốc html.

Lưu ý: phần tử gốc html chỉ có một phần tử con head, và head chỉ có một phần tử con title.

Bài tập này là một phần của khóa học

Web Scraping với Python

Xem khóa học

Hướng dẫn bài tập

  • Gán cho biến this_url URL được dùng để nạp biến response.
  • Gán cho biến this_title tiêu đề của trang web được dùng để nạp biến response. Vì bạn chỉ muốn văn bản từ đúng một phần tử được chọn, hãy dùng phương thức extract_first() để trích xuất văn bản.
  • Dù bạn dùng xpath hay css, hãy đảm bảo bạn đang chọn văn bản bên trong phần tử title, không chỉ bản thân phần tử title.

Bài tập tương tác thực hành trực tiếp

Hãy thử làm bài tập này bằng cách hoàn thành đoạn mã mẫu này.

# Get the URL to the website loaded in response
this_url = ____

# Get the title of the website loaded in response
this_title = response.____.extract_first()

# Print out our findings
print_url_title( this_url, this_title )
Chỉnh sửa và Chạy Mã