Amazon Bedrock Model Evaluation のヒューマン評価ジョブを設定し、AWS IAM Identity Center で管理した医師チームをレビュアーとして割り当てる
✓ 正解
Amazon Bedrock Model Evaluation のヒューマン評価ジョブは、IAM Identity Center で認証された社内専門家をレビュアーとして指定し、プロンプト/応答セットを構造化ワークフローで体系的に評価できます。臨床的正確性のような専門的判断が必要な基準でも再現可能な評価が実施でき、今回の要件に最も合致します。
B
Amazon SageMaker Ground Truth で医師チームのプライベートワークフォースを構成し、Bedrock の出力をアノテーションタスクとして配信する
Amazon SageMaker Ground Truth は機械学習モデルの学習データ作成・アノテーションに特化したサービスです。生成 AI モデルの推論品質を評価する体系的なフレームワークとしては設計されておらず、Bedrock 応答の評価専用 UI や結果集計機能も持ちません。