ある企業が Amazon Bedrock の Knowledge Bases を使用した社内ナレッジ管理システムを RAG(検索拡張生成:Retrieval-Augmented Generation)アーキテクチャで構築しています。このシステムはドキュメントを検索してから回答を生成しますが、コンプライアンスチームは、検索されたドキュメントに基づかない回答(ハルシネーション)が生成されることを懸念しています。Amazon Bedrock Guardrails のどの機能を有効にすることで、ソースコンテキストに根拠を持たない応答を検出してブロックできますか?
Bedrock Guardrails のコンテキストグラウンディングポリシー(グラウンディングチェック)は、モデルの応答が提供されたソースコンテキスト(検索されたドキュメント)に基づいているかを評価し、根拠が不十分な場合はブロックします。これがハルシネーション軽減に最も直接対応する機能です。 選択肢Aのコンテンツフィルターは暴力(VIOLENCE)やヘイト(HATE)など有害なコンテンツを検出・ブロックするための機能であり、応答がソースコンテキストに根拠を持つかどうかの評価には対応していません。 選択肢Bの拒否トピックは指定した特定のトピックに関する応答を拒否する機能であり、ハルシネーション(根拠のない応答)の検出・ブロックを目的としたものではありません。 選択肢Dのワードフィルターは特定の単語やフレーズを含む応答をブロックする機能であり、ソースコンテキストとの整合性(グラウンディング)を評価する機能ではありません。