Texte de premier niveau
Dans cet exercice, vous allez écrire une chaîne XPath et un sélecteur CSS pour cibler le texte d'un élément de paragraphe p précis. L'élément p dans le HTML est défini de façon unique par son attribut id, qui vaut "p3". Avec cette petite information, vous devriez pouvoir créer les chaînes voulues; toutefois, nous avons préchargé la variable html avec une chaîne contenant le HTML auquel ce lien appartient, si vous souhaitez l'examiner.
Dans cet exercice, vous ne sélectionnerez que le texte à l'intérieur de l'élément, ce qui n'inclut pas le texte des générations futures de l'élément. Nous avons créé une fonction print_results pour vous permettre de comparer les éléments vers lesquels vos chaînes pointent.
Cette activité fait partie du cours
Extraction de données Web en Python
Instructions de l’exercice
- Assignez à la variable
xpathune chaîne XPath qui pointe vers le texte à l'intérieur de l'élément de paragraphepdont l'idest égal àp3, sans inclure le texte des générations futures de cet élémentp. - Assignez à la variable
css_locatorun sélecteur CSS qui pointe vers ce même texte.
Exercice interactif pratique
Essayez cet exercice en complétant ce code d’exemple.
# Create an XPath string to the desired text.
xpath = ____
# Create a CSS Locator string to the desired text.
css_locator = ____
# Print the text from our selections
print_results( xpath, css_locator )