イミュータビリティと遅延処理が、Sparkのデータ処理における基本概念であることを学びました。では、そもそもなぜSparkはイミュータブルなDataFrameを採用しているのでしょうか?
この演習はコースの一部です
理論を実践に変える、インタラクティブな演習のひとつをお試しください
DataFrame の基礎と、データクレンジングの重要性を復習します。
現在の演習
Spark で DataFrame の内容を変更するさまざまな手法を見ていきます。
パフォーマンスを高めたりリソース要件を減らしたりして、データクレンジング作業を改善します。
Spark を使って複雑な実データを処理し、パイプラインの基本を学びます。