金融機関が Amazon Bedrock 上に構築した顧客向けチャットボットにおいて、悪意あるユーザーがシステムプロンプトの指示を無視させるプロンプトインジェクション攻撃が確認された。また、モデルの応答に口座番号や社会保障番号が含まれるケースも報告されている。セキュリティチームは追加の運用オーバーヘッドを最小化しながらこれら両方の脅威を同時に防御したい。どのアプローチが最も適切か。
Bedrock Guardrailsはプロンプト攻撃フィルタ(意味レベルのインジェクション検出)と機密情報ポリシー(PIIマスキング)を単一マネージドサービスで提供し、入出力両方に適用できる。追加開発なしで両要件を同時に満たせる。