Zacznij terazZacznij za darmo

Odkryj za pomocą Response

Wstępnie załadowaliśmy obiekt Response o nazwie response z zawartością tajnej strony internetowej. Twoim zadaniem jest ustalenie jej URL-a i tytułu przy użyciu zmiennej response. Sposobu na znalezienie URL-a nauczyłeś się w poprzedniej lekcji. Aby znaleźć tytuł strony, musisz wiedzieć, że:

  • Tytuł to tekst z elementu title
  • Element title jest dzieckiem elementu head, który z kolei jest dzieckiem korzenia html.

Warto zaznaczyć: korzeń html ma dokładnie jeden element podrzędny head, a element head ma dokładnie jeden element podrzędny title.

To ćwiczenie jest częścią kursu

Web Scraping w Pythonie

Zobacz kurs

Instrukcje do ćwiczenia

  • Przypisz do zmiennej this_url URL użyty do załadowania zmiennej response.
  • Przypisz do zmiennej this_title tytuł strony internetowej użytej do załadowania zmiennej response. Ponieważ chcemy uzyskać tekst tylko z jednego wybranego elementu, użyj metody extract_first(), aby go wyodrębnić.
  • Niezależnie od tego, czy korzystasz z xpath, czy css, upewnij się, że wybierasz tekst wewnątrz elementu title, a nie sam element title.

Interaktywne ćwiczenie praktyczne

Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.

# Get the URL to the website loaded in response
this_url = ____

# Get the title of the website loaded in response
this_title = response.____.extract_first()

# Print out our findings
print_url_title( this_url, this_title )
Edytuj i uruchom kod