次のうち、正しくないものを選んでください。
この演習はコースの一部です
理論を実践に変える、インタラクティブな演習のひとつをお試しください
HTMLの構造を学びます。まず、Webスクレイピングがデータサイエンスの道具箱にとって有用である理由を説明し、HTMLの基礎に踏み込みます。章の最後には、HTMLコード内の要素をたどるために使うXPath表記の概要を紹介します。
現在の演習
XPathの文法を活用してscrapyのセレクターを探ります。これらの概念を理解することで、HTMLドキュメントをスクレイピングできるようになります。
CSSロケーターの文法を学び、CSSロケーターをXPathと連結して使う発想に触れます。さらに、セレクターのように振る舞いつつ、複数サイトにまたがるスクレイピングを進めるための追加機能を備えたResponseオブジェクトも紹介します。
scrapyでウェブクローラーを作成する方法を学びます。これらのscrapyスパイダーは、前章までに学んだ手順に従ってリンクをたどり、複数ページにわたって自動的にスクレイピングします。