このレッスンでは、データエンジニアリングのプロセスをより効率的にする方法について多く取り上げました。この演習では、データの基盤となるレイアウトを最適化する方法を練習します。これにより、分析であれ単純なデータ読み取りであれ、後続のすべてのデータ処理をより高速かつ効率的に実行できるようになります。
この演習はコースの一部です
理論を実践に変える、インタラクティブな演習のひとつをお試しください
Databricks Data Intelligence Platform で、データウェアハウスの確かな基礎を築きましょう。Databricks とレイクハウスアーキテクチャが、組織にとって最新の SQL・BI スタックをどのように実現するのかを学びます。さらに、データストレージ手法からコンピュートの最適化まで、Databricks SQL 製品の主要コンポーネントを探っていきます。
レイクハウスアーキテクチャのための強固なデータ基盤を構築しましょう。Databricks SQL の機能を使って、データを取り込み、変換し、モデリングする方法を学びます。GUI ベースおよびプログラムによるアプローチの両方でメダリオンアーキテクチャを構築し、あらゆる分析ワークロードに対応できるデータエコシステムを整える方法を探っていきます。
Databricks SQL を使って、説得力のあるデータインサイトを生み出しましょう。プラットフォーム内の機能を使ってクエリを記述し、可視化を作成し、ダッシュボードを動かす方法を学びます。SQL コード、フィルター、パラメーターを活用して、エンドユーザー向けの堅牢な分析アプリケーションを構築する練習をします。
最終章では、Databricks プラットフォームならではの強みを活かした、より高度な手法を学びます。ウィンドウ関数を使って高速かつ変化の激しいデータを処理する方法を習得し、データが到着するたびにデータセットをマージできるようになります。
現在の演習