無限ノック › DEA 練習問題一覧 › 問題
DEAデータストアの管理

ある大企業は、中央データウェアハウスとして Amazon Redshift クラスター(プロデューサー)を運用しています。 複数の事業部門がそれぞれ独立した Redshift クラスター(コンシューマー)を持ち、以下の要件があります。 ・中央データウェアハウスのデータにほぼリアルタイムでアクセスしたい ・データを物理的にコピー・複製するコストや管理オーバーヘッドを避けたい ・各事業部門のクラスターから中央データに対して SQL クエリを実行したい これらの要件を最もシンプルに満たす AWS のソリューションはどれですか?

A
AWS Glue ETL ジョブを使って毎晩プロデューサークラスターから各コンシューマークラスターにデータをレプリケーションする
毎晩の ETL レプリケーションはリアルタイム性を満たさず、データ複製コストと ETL ジョブの管理オーバーヘッドが発生します。
B
Amazon Redshift データ共有(Data Sharing)を設定し、コンシューマークラスターからプロデューサーのデータに直接アクセスできるようにする
✓ 正解
Amazon Redshift データ共有(Data Sharing)を設定し、コンシューマークラスターからプロデューサーのデータに直接アクセスできるようにする Redshift Data Sharing はデータをコピーせず、コンシューマークラスターがプロデューサーのライブデータに直接 SQL アクセスできる機能です。同一アカウント内および別アカウントのクラスター間でも利用でき、ほぼリアルタイムのアクセス・データコピー不要・SQL クエリ対応の要件をすべて最小構成で満たします。
C
Redshift Spectrum を使用してプロデューサーのデータを定期的に Amazon S3 にアンロードし、全クラスターが S3 を共通ソースとしてクエリする
S3 への定期アンロードでは鮮度が低下し、アンロードパイプラインの管理が必要になります。
D
Amazon Aurora グローバルデータベースのリードレプリカを各リージョンに配置し、事業部門のクエリをリードレプリカに向ける
Amazon Aurora は OLTP 向けリレーショナルデータベースであり、Redshift の大規模分析ワークロードの代替にはなりません。

解説

Amazon Redshift データ共有(Data Sharing)を設定し、コンシューマークラスターからプロデューサーのデータに直接アクセスできるようにする Redshift Data Sharing はデータをコピーせず、コンシューマークラスターがプロデューサーのライブデータに直接 SQL アクセスできる機能です。同一アカウント内および別アカウントのクラスター間でも利用でき、ほぼリアルタイムのアクセス・データコピー不要・SQL クエリ対応の要件をすべて最小構成で満たします。 選択肢Aは、毎晩の ETL レプリケーションはリアルタイム性を満たさず、データ複製コストと ETL ジョブの管理オーバーヘッドが発生します。 選択肢Cは、S3 への定期アンロードでは鮮度が低下し、アンロードパイプラインの管理が必要になります。 選択肢Dは、Amazon Aurora は OLTP 向けリレーショナルデータベースであり、Redshift の大規模分析ワークロードの代替にはなりません。

ドメイン別正答率・予想スコアでリアルタイムに実力把握

無限ノックでDEAを徹底対策。全問AI生成のオリジナル問題。

無料で演習を始める →
← DEA の問題一覧に戻る