AWS GlueのストリーミングETLジョブはSparkベースのジョブ開発・管理・スケーリング考慮が必要で、Amazon Data Firehoseの組み込み変換に比べ運用負荷が高く、最小化要件に最も適さないため不適切です。
解説
Amazon Data Firehoseは、フルマネージドの配信サービスで、スループットに応じて自動スケールし、コンシューマーの開発・運用が不要です。組み込み機能でデータをParquet形式に変換してS3へ配信でき、OpenSearch Serviceへの配信にも対応するため、運用負荷を最小化しつつ全要件を満たします。
選択肢のKinesis Data StreamsはEC2やLambdaでコンシューマーを自前実装・運用する必要があり、運用負荷が大きくなります。
選択肢のAmazon MSKはKafkaクラスターやKafka Connectの構成・管理が必要で、運用負荷最小化の要件に反します。
選択肢のAWS GlueストリーミングETLはジョブの開発・管理が必要で、Amazon Data Firehoseに比べて運用負荷が高くなります。