AIF基盤モデルのアプリケーション
ある企業が、Amazon Bedrock 上で利用可能な複数の基盤モデルの中から、自社の要約タスクに最も適したモデルを選定したいと考えています。マネージドな仕組みを使い、自動指標による評価と人間によるレビューの両方で複数モデルの品質を比較したいです。最も適した機能はどれですか。
AAmazon Bedrock Model Evaluation を使ってモデルを比較評価する
✓ 正解
複数の基盤モデルを自動指標と人間によるレビューの両方で比較評価できるマネージド機能で、タスクに最適なモデルを選定したい本要件に合致します。要約品質の比較にそのまま利用できます。
BAmazon Bedrock Guardrails を使って出力を制御する
有害・不適切な入出力をフィルタリングする安全性のための機能であり、複数モデルの品質を比較評価する用途ではありません。モデル選定が目的の本要件には対応しません。
CAmazon Bedrock Knowledge Bases を使って RAG を構築する
RAGのために外部データソースを管理・検索する機能であり、複数モデルの評価・比較を行うものではありません。モデル選定という本要件の目的には合致しません。
DAmazon SageMaker Ground Truth を使ってデータをラベリングする
機械学習の学習用データに人手でラベルを付与するサービスであり、基盤モデルの品質比較や選定には使用しません。評価が目的の本要件には適しません。
解説
Amazon Bedrock Model Evaluation は、複数の基盤モデルを自動指標(精度・堅牢性・毒性など)や人間によるレビューで比較評価できるマネージド機能です。
タスクに最適なモデルを選定する用途に対応しており、本要件に最適です。
選択肢BのGuardrailsは、有害・不適切な入出力を制御する安全機能で、モデルの品質比較・選定を行う機能ではない。
選択肢CのKnowledge Basesは、RAGのためのデータソース管理機能で、モデル間の評価・比較が目的ではない。
選択肢DのSageMaker Ground Truthは、学習用データのラベリングを行うサービスで、基盤モデルの比較評価には用いない。
ドメイン別正答率・予想スコアでリアルタイムに実力把握
無限ノックでAIFを徹底対策。全問AI生成のオリジナル問題。
無料で演習を始める →