グローバルな金融サービス企業が、Amazon Bedrockを使用したドキュメント要約システムを構築しています。毎晩10万件以上のドキュメントを処理する必要がありますが、結果はリアルタイムでは不要で翌朝までに完了していれば十分です。オンデマンド推論では頻繁にスロットリングが発生しており、Provisioned Throughputはコストが高すぎます。最もコスト効率が高い解決策はどれですか?
Amazon Bedrock Batch Inferenceは、大量リクエストを非同期でまとめて処理するマネージド機能であり、オンデマンド推論と比較して最大50%のコスト削減が可能です。S3にJSONL形式の入力ファイルをアップロードしてバッチジョブを作成するだけで実装でき、スロットリングも発生しません。リアルタイム性が不要なユースケースに最適です。 選択肢BのAWS Step Functionsを使用したLambda関数のオーケストレーションは、運用複雑度が高くなります。 選択肢CのAmazon SQSでのバッファリングは、複数のLambda関数での並列処理では指数バックオフで再試行ロジックを実装する必要があり複雑です。 選択肢DのAmazon EventBridgeスケジューラーでのAPI呼び出しの分散は、スループット向上に限界があります。