Redshift のようなカラム型データベースは、データ分析、レポーティング、集計に強みがあります。データを列ごとに保存するため、合計や件数の計算、フィルタリングといった操作を効率的に実行できます。必要な列だけを読み込み、行全体を読み込まないため I/O を最小化でき、クエリ実行が高速になります。
この演習はコースの一部です
理論を実践に変える、インタラクティブな演習のひとつをお試しください
堅牢なカラムナ型データウェアハウスであるRedshiftを見ていきます。カラムナ型と一般的なデータウェアハウスの違い、Redshiftの特長、AWSやデータウェアハウスのエコシステム内での位置づけ、そして対応するデータ型について学びます。
現在の演習
PostgreSQLの構文に近い、Redshift SQL構文の細かな違いを学びましょう。まずCTEとサブクエリを比較し、その後、日付と時刻の扱い、ウィンドウクエリの活用を学び、最後にトランザクションが一部の関数に与える影響を確認します。
テーブルの作成方法、DISTKEYやSORTKEYがパフォーマンスに与える影響、Spectrumによる外部スキーマ/テーブルを取り上げ、最後にRedshiftでJSONのような半構造化データを扱う方法で締めくくります。
最適化されたクエリの書き方と、その支援に役立つツールを覗いてみましょう。続いて、Redshiftのセキュリティ機能と、それがクエリ結果に与える影響に目を向けます。