Začněte nyníZačněte zdarma

Hyper(od)kaz v akci

Jedním z nejdůležitějších atributů při „procházení webu" je URL hypertextového odkazu (atribut href) uvnitř tagu a. V tomto cvičení takový odkaz extrahuješ! Funkce print_attribute je připravená k použití – vypíše data získaná z tvého XPath, takže si XPath řetězce můžeš vyzkoušet přímo v konzoli.

Cvičení se vztahuje k následujícímu HTML zdrojovému kódu:

<html>
  <body>
    <div id="div1" class="class-1">
      <p class="class-1 class-2">Hello World!</p>
      <div id="div2">
        <p id="p2" class="class-2">Choose 
            <a href="http://datacamp.com">DataCamp!</a>!
        </p>
      </div>
    </div>
    <div id="div3" class="class-2">
      <p class="class-2">Thanks for Watching!</p>
    </div>
  </body>
</html>

Toto cvičení je součástí kurzu

Web Scraping v Pythonu

Zobrazit kurz

Pokyny k cvičení

  • Doplň prázdná místa a dokonči proměnnou xpath níže tak, aby vybírala hodnotu atributu href z hypertextového odkazu na DataCamp.

Interaktivní cvičení na vyzkoušení si v praxi

Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.

# Create an xpath to the href attribute
xpath = '//p[@id=____]/a/____'

# Print out the selection(s); there should be only one
print_attribute( xpath )
Upravit a spustit kód