ある金融サービス企業では、15の異なるソースシステムからCSV形式のトランザクションデータが毎日届きます。プログラミングスキルを持たないビジネスアナリストが、以下のデータ品質プロファイリングと標準化変換をコードなしで実施し、結果を視覚的に確認する必要があります。 ・日付フォーマットの不統一 ・文字列の余分なスペース ・欠損値の割合確認 この要件を最もよく満たすサービスはどれですか?
選択肢AのSageMaker Data Wranglerは、視覚的なデータ準備ツールですが、ML用途・SageMaker統合向けであり、汎用的なデータ品質管理にはDataBrewが適切です。 選択肢BのGlue ETLは、PythonコードやSparkスクリプトの記述が必要なため、プログラミングスキルを持たないビジネスアナリストには不向きです。 選択肢CのAWS Glue DataBrewは、コード不要のビジュアル型データ準備・プロファイリングサービスで、250以上の組み込み変換と自動データ品質プロファイリング(欠損値割合・外れ値・重複の可視化)を提供し、最適な選択です。 選択肢DのSageMaker Processingは、scikit-learnなどのPythonコードの記述が必要なため、プログラミングスキルを持たないビジネスアナリストには不向きです。