ある不動産テック企業がAmazon Bedrockを使って物件説明文を自動生成するシステムを構築しています。生成されたテキストが物件データベースの事実(床面積・築年数・設備の有無)と一致しているかを検証する品質ゲートが必要です。モデルが存在しない設備を追加したり数値を誤って生成するハルシネーションを自動的に検出・ブロックしたいと考えています。最もAWSネイティブで効果的な実装はどれですか?
Amazon Bedrock GuardrailsのGrounding Check(グラウンディングチェック)機能は、モデルが生成したテキストがプロンプト内に提供されたソース情報に根拠を持つかを自動的に検証するハルシネーション検出機能です。Guardrails設定でグラウンディングチェックを有効化し、グラウンディングスコアの閾値を設定すると、生成テキストがソース情報と一致しない箇所(物件データに記載のない設備の追加・数値の誤りなど)が検出されたレスポンスは自動的にBLOCKされるかカスタムメッセージに置換されます。追加のインフラや外部サービスを必要とせず、Guardrails設定のみで実装できるAWSネイティブな解決策です。 選択肢AのAmazon Comprehendはエンティティ抽出には優れていますが、抽出した値が物件データと意味的に一致するかを判断するロジックを別途実装する必要があり、「バス停から徒歩5分」のような文脈依存の事実判断には対応できません。 選択肢CのOpenSearch Serverlessによるコサイン類似度アプローチはセマンティックな意味の近さを測定しますが、数値の微妙な違い(50㎡と55㎡など)は類似度が高く出る場合があり、事実の正確性検証には精度が不十分です。また専用ベクトルDBインフラの構築・管理が必要です。 選択肢DのClaude HaikuによるLLM-as-judgeアプローチは精度面では有効ですが、生成リクエストごとに追加のLLM呼び出しコストが発生し、GuardrailsのGrounding Checkが同等の機能をマネージドで提供している場合と比べてコストと実装複雑さが増します。