AgentShield logo

AgentShield

AIエージェント向けのプロンプトインジェクション検出API

Artificial Intelligence Developer Tools GitHub Security

AgentShieldは、信頼できない入力をAIエージェントに渡す前に検知・分類する外部セキュリティ層です。1回のAPI呼び出しで、ユーザーメッセージ・RAGドキュメント・ツール出力を含む任意のテキストを分類し、モデルに届く前に判定を返します。LLMのWAFのような役割を果たします。主な分類は4つ:直接インジェクション、間接インジェクション、ソーシャルエンジニアリング、エンコーディングのトリック。利用形態と料金:無料プランは日100リクエスト、データをオンプレミスで保持する場合はセルフホスト Docker イメージ。背景には Johns Hopkins の研究者によるプロンプトインジェクション攻撃をきっかけに開発し、モデル側だけでは対処しきれない課題に対する外部層の必要性。

投票数: 1
← 投稿一覧に戻る