あるデータエンジニアリングチームは、外部パートナーがAmazon S3の特定のプレフィックスにCSVファイルをアップロードするたびに、AWS Glue ETLジョブを自動的に起動する仕組みを構築したいと考えています。 要件は以下の通りです。 ・サーバーレス構成でカスタムコードを最小化すること ・ファイルアップロードから数分以内にジョブを起動すること ・運用負荷を最小化すること これらの要件を最も満たすアーキテクチャはどれですか?
Amazon S3はバケット設定でAmazon EventBridgeへのイベント通知送信をサポートしています。EventBridgeルールで対象バケット・プレフィックス・イベントタイプを指定し、AWS Glueワークフローをターゲットに設定することで、カスタムコード不要のサーバーレスな自動起動パイプラインを構築できます。 選択肢BのLambdaポーリング方式は1分ごとの確認による起動遅延が生じる上、コード実装・管理が必要で運用負荷が増加します。 選択肢CのS3ライフサイクルポリシーはETLジョブの起動機能がありません。 選択肢DのCLIスクリプトはパートナーとの依存関係が生じ、自動化の信頼性が低く運用負荷が高くなります。