CommencezCommencez gratuitement

Texte à tous les niveaux

Cet exercice ressemble au précédent, mais vous devrez cette fois sélectionner le texte à travers plusieurs générations d'un même élément.

Vous écrirez des chaînes XPath et CSS Locator pour pointer vers le texte d'un élément de paragraphe p précis. L'élément p dans le code HTML est défini de manière unique par son attribut id, soit "p3". Avec cette information, vous devriez pouvoir créer les chaînes demandées; nous avons toutefois préchargé la variable html avec une chaîne contenant le HTML auquel ce lien appartient, si vous souhaitez l'examiner.

Dans cet exercice, vous sélectionnerez uniquement le texte à l'intérieur de l'élément qui inclut tout le texte de ses générations futures. Nous avons créé une fonction print_results pour vous permettre de comparer les éléments vers lesquels vos chaînes pointent.

Cette activité fait partie du cours

Extraction de données Web en Python

Voir le cours

Instructions de l’exercice

  • Affectez à la variable xpath une chaîne XPath qui pointe vers le texte à l'intérieur de l'élément de paragraphe p dont l'id est égal à p3, et qui inclut le texte des générations futures de cet élément p.
  • Affectez à la variable css_locator une chaîne de repérage CSS (CSS Locator) qui pointe vers ce même texte.

Exercice interactif pratique

Essayez cet exercice en complétant ce code d’exemple.

# Create an XPath string to the desired text.
xpath = ____

# Create a CSS Locator string to the desired text.
css_locator = ____

# Print the text from our selections
print_results( xpath, css_locator )
Modifier et exécuter le code