無限ノック › DOP 練習問題一覧 › 問題
DOPモニタリングとロギング

あるEコマース企業はLambda関数・Amazon DynamoDB・Amazon SQSを組み合わせたサーバーレスの注文処理システムを運用しています。運用上の課題として、①個別のCloudWatchメトリクスアラームが誤検知を多発させている、 ②Lambdaエラー率の増加・DynamoDBのスロットリング・SQSキュー深度の増大という複数サービスにまたがる異常を相関させて根本原因を特定するには手動調査が必要、 ③顧客への影響が発生する前にプロアクティブに問題を検知したい、という3点があります。手動での閾値設定なしに複数AWSリソースにわたる運用上の異常をMLで自動的に相関させるマネージドサービスの組み合わせとして最適なものはどれですか?

A
AWS X-Rayのサービスマップを有効化し、フィルター式を使ったX-Rayグループを設定してエラーパターンを自動検出する
X-Rayは分散トレーシングでレイテンシーやエラーの追跡はできますが、複数サービスのメトリクス異常をMLで自動相関し閾値設定なしにプロアクティブ検知する用途には設計されておらず要件を満たしません。
B
CloudWatch Anomaly Detectionをメトリクス数式と組み合わせ、Lambda・DynamoDB・SQSの複数メトリクスを相関させるコンポジットアラームを手動設計する
CloudWatch Anomaly Detectionは個別メトリクスの異常検知はできますが、相関はコンポジットアラームを手動設計する必要があり、手動不要で複数サービスを自動相関するという要件に反します。
C
Amazon DevOps Guruを有効化してSNS通知を設定する。MLでCloudWatchメトリクスとCloudTrailを分析し複数サービスの異常を自動相関する
✓ 正解
Amazon DevOps GuruはフルマネージドなML運用サービスで、CloudWatchメトリクスとCloudTrailを継続分析しLambda・DynamoDB・SQS横断の異常を手動閾値なしに自動相関してInsightを生成し、プロアクティブに検知します。
D
AWS Trusted Advisorを利用し、Support APIで定期的に運用上の推奨事項をポーリングして問題を検出する
Trusted Advisorはベストプラクティスのチェックが目的で、運用異常をMLで相関検知する機能はなく、Support APIのポーリングも即時性に欠け要件を満たしません。

解説

正解: Amazon DevOps Guruを有効化してSNSへの通知を設定する。DevOps GuruはCloudWatchメトリクスとCloudTrailイベントをMLモデルで分析し、Lambda・DynamoDB・SQSにわたる異常を自動相関させてInsight(洞察)を生成し、プロアクティブな問題検知も行う。 Amazon DevOps Guruはフルマネージドな機械学習ベースの運用サービスです。CloudWatchメトリクスとCloudTrailイベントを継続的に分析し、複数リソースにまたがる異常を自動相関させてInsightを生成します。Lambdaエラー率の上昇・DynamoDBのスロットリング・SQSキュー深度の増加を個別の問題としてではなく、一つの根本原因に紐づく関連現象として提示し、修復アクションの推奨も行います。プロアクティブInsight(事前警告)機能により顧客影響前の検知が可能で、SNS通知で既存の対応フローとも統合できます。手動での閾値設定は一切不要です。 選択肢Aは、AWS X-Rayのサービスマップはサービス間の呼び出し関係とレイテンシー・エラーを可視化しますが、複数サービスにまたがるML自動相関やプロアクティブInsight生成は行いません。根本原因の特定には依然として手動調査が必要です。 選択肢Bは、CloudWatch Anomaly Detectionは個別メトリクスのMLベース異常検知を提供しますが、複数サービスにまたがる異常の自動相関分析や統合Insight生成の機能はありません。メトリクス数式によるコンポジットアラームの設計には手動作業が必要であり、①の課題解決にもなりません。 選択肢Dは、Trusted Advisorはサービスクォータ・セキュリティ設定・コスト最適化といった構成上のベストプラクティスをチェックするサービスであり、実行時のメトリクス異常のリアルタイム相関分析やプロアクティブ検知は提供しません。

ドメイン別正答率・予想スコアでリアルタイムに実力把握

無限ノックでDOPを徹底対策。全問AI生成のオリジナル問題。

無料で演習を始める →
← DOP の問題一覧に戻る