AIに「守って」とお願いするだけで大丈夫? Guardrailsで安全なAIエージェントを作ってみた
生成AIを業務で使う機会が増えています。一方で、実際のサービスにAIを組み込むとなると、「答えてはいけない内容に回答してしまったら?」「個人情報がそのままAIに渡ってしまったら?」「社内文書に書かれていないことを、もっともらしく回答してしまったら?」といったことも考えなければなりません。システムプロンプトに、「この内容には回答しないでください」と書く方法もあります。しかし、AIへの指示だけですべての入出力を確実に制御するのは困難です。そこで今回は、Strands AgentsとAmazon Bedrock Guardrailsを組み合わせ、AIにルールを守るよう指示するだけでなく、システ...