Bật mí qua Response
Chúng tôi đã nạp sẵn một đối tượng Response, tên là response, với nội dung từ một trang web bí mật. Nhiệm vụ của bạn là tìm ra URL và tiêu đề của trang web bằng biến response. Bạn đã học cách tìm URL ở bài trước. Để tìm tiêu đề trang, bạn cần biết rằng:
- Tiêu đề là văn bản của phần tử
title - Phần tử
titlelà con của phần tửhead, vàheadlà con của phần tử gốchtml.
Lưu ý: phần tử gốc html chỉ có một phần tử con head, và head chỉ có một phần tử con title.
Bài tập này là một phần của khóa học
Web Scraping với Python
Hướng dẫn bài tập
- Gán cho biến
this_urlURL được dùng để nạp biếnresponse. - Gán cho biến
this_titletiêu đề của trang web được dùng để nạp biếnresponse. Vì bạn chỉ muốn văn bản từ đúng một phần tử được chọn, hãy dùng phương thứcextract_first()để trích xuất văn bản. - Dù bạn dùng
xpathhaycss, hãy đảm bảo bạn đang chọn văn bản bên trong phần tử title, không chỉ bản thân phần tử title.
Bài tập tương tác thực hành trực tiếp
Hãy thử làm bài tập này bằng cách hoàn thành đoạn mã mẫu này.
# Get the URL to the website loaded in response
this_url = ____
# Get the title of the website loaded in response
this_title = response.____.extract_first()
# Print out our findings
print_url_title( this_url, this_title )