Odhalení pomocí Response
Do objektu Response s názvem response jsme předem načetli obsah tajné webové stránky. Tvým úkolem je zjistit URL adresu a název této stránky pomocí proměnné response. Jak získat URL adresu, ses naučil/a v předchozí lekci. Pro nalezení názvu stránky potřebuješ vědět:
- Název je text elementu
title - Element
titleje potomkem elementuhead, který je potomkem kořenového elementuhtml.
Poznámka: kořenový element html má právě jeden podřízený element head a element head má právě jeden podřízený element title.
Toto cvičení je součástí kurzu
Web Scraping v Pythonu
Pokyny k cvičení
- Do proměnné
this_urlpřiřaď URL adresu, která byla použita k načtení proměnnéresponse. - Do proměnné
this_titlepřiřaď název webové stránky načtené do proměnnéresponse. Protože chceme získat text pouze z jednoho elementu, použij metoduextract_first(). - Ať už použiješ
xpathnebocss, ujisti se, že vybíráš text uvnitř elementu title, a ne jen element samotný.
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Get the URL to the website loaded in response
this_url = ____
# Get the title of the website loaded in response
this_title = response.____.extract_first()
# Print out our findings
print_url_title( this_url, this_title )