Texte à tous les niveaux
Cet exercice ressemble au précédent, mais vous devrez cette fois sélectionner le texte à travers plusieurs générations d'un même élément.
Vous écrirez des chaînes XPath et CSS Locator pour pointer vers le texte d'un élément de paragraphe p précis. L'élément p dans le code HTML est défini de manière unique par son attribut id, soit "p3". Avec cette information, vous devriez pouvoir créer les chaînes demandées; nous avons toutefois préchargé la variable html avec une chaîne contenant le HTML auquel ce lien appartient, si vous souhaitez l'examiner.
Dans cet exercice, vous sélectionnerez uniquement le texte à l'intérieur de l'élément qui inclut tout le texte de ses générations futures. Nous avons créé une fonction print_results pour vous permettre de comparer les éléments vers lesquels vos chaînes pointent.
Cette activité fait partie du cours
Extraction de données Web en Python
Instructions de l’exercice
- Affectez à la variable
xpathune chaîne XPath qui pointe vers le texte à l'intérieur de l'élément de paragraphepdont l'idest égal àp3, et qui inclut le texte des générations futures de cet élémentp. - Affectez à la variable
css_locatorune chaîne de repérage CSS (CSS Locator) qui pointe vers ce même texte.
Exercice interactif pratique
Essayez cet exercice en complétant ce code d’exemple.
# Create an XPath string to the desired text.
xpath = ____
# Create a CSS Locator string to the desired text.
css_locator = ____
# Print the text from our selections
print_results( xpath, css_locator )