CommencezCommencez gratuitement

Révéler avec Response

Nous avons préchargé un objet Response, nommé response, avec le contenu d'un site Web secret. Votre tâche est de trouver l'URL et le titre du site en utilisant la variable response. Vous avez appris à trouver l'URL dans la leçon précédente. Pour trouver le titre du site, voici ce qu'il faut savoir :

  • Le titre correspond au texte de l'élément title
  • L'élément title est un enfant de l'élément head, lui-même enfant de l'élément racine html.

À noter : l'élément racine html n'a qu'un seul enfant head, et l'élément head n'a qu'un seul enfant title.

Cette activité fait partie du cours

Extraction de données Web en Python

Voir le cours

Instructions de l’exercice

  • Assignez à la variable this_url l'URL utilisée pour charger la variable response.
  • Assignez à la variable this_title le titre du site Web utilisé pour charger la variable response. Comme nous voulons seulement le texte de l'unique élément sélectionné, utilisez la méthode extract_first() pour l'extraire.
  • Que vous utilisiez xpath ou css, assurez-vous de sélectionner le texte à l'intérieur de l'élément title, et non seulement l'élément title lui-même.

Exercice interactif pratique

Essayez cet exercice en complétant ce code d’exemple.

# Get the URL to the website loaded in response
this_url = ____

# Get the title of the website loaded in response
this_title = response.____.extract_first()

# Print out our findings
print_url_title( this_url, this_title )
Modifier et exécuter le code