Odkryj za pomocą Response
Wstępnie załadowaliśmy obiekt Response o nazwie response z zawartością tajnej strony internetowej. Twoim zadaniem jest ustalenie jej URL-a i tytułu przy użyciu zmiennej response. Sposobu na znalezienie URL-a nauczyłeś się w poprzedniej lekcji. Aby znaleźć tytuł strony, musisz wiedzieć, że:
- Tytuł to tekst z elementu
title - Element
titlejest dzieckiem elementuhead, który z kolei jest dzieckiem korzeniahtml.
Warto zaznaczyć: korzeń html ma dokładnie jeden element podrzędny head, a element head ma dokładnie jeden element podrzędny title.
To ćwiczenie jest częścią kursu
Web Scraping w Pythonie
Instrukcje do ćwiczenia
- Przypisz do zmiennej
this_urlURL użyty do załadowania zmiennejresponse. - Przypisz do zmiennej
this_titletytuł strony internetowej użytej do załadowania zmiennejresponse. Ponieważ chcemy uzyskać tekst tylko z jednego wybranego elementu, użyj metodyextract_first(), aby go wyodrębnić. - Niezależnie od tego, czy korzystasz z
xpath, czycss, upewnij się, że wybierasz tekst wewnątrz elementutitle, a nie sam elementtitle.
Interaktywne ćwiczenie praktyczne
Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.
# Get the URL to the website loaded in response
this_url = ____
# Get the title of the website loaded in response
this_title = response.____.extract_first()
# Print out our findings
print_url_title( this_url, this_title )