データレイクをS3上に構築しており、数ペタバイトのデータがParquet形式で保存されています。データ分析チームは、標準的なSQLを使用してこれらのデータを頻繁にクエリしたいと考えています。同時に、特定の機密データ列へのアクセスを、特定のIAMロールのみに制限する必要があります。どのソリューションが最も適切ですか?
AthenaがS3上のデータを直接SQLでクエリできるサーバーレスサービスであり、Lake Formationと組み合わせることで、列レベルや行レベルのきめ細かなアクセス制御を容易に実現できるためです。これが最も管理負担が少なくスケーラブルです。 選択肢Aはデータロードにコストがかかりすぎます。 選択肢Cは「ファイル単位」の制御であり、列レベルの制限は不可能です。 選択肢Dはクラスター管理が必要で、Athenaよりも運用負荷が高くなります。