パターンを読み込んでいます…
ツール悪用防止パターン(TMP)
エージェントが操作され、ツールを通じて悪意ある操作を実行させられるのを防ぐ
30秒でわかる概要
- 概要
- 権限境界、アクションの検証、サンドボックス化、監査ログ、レート制限によって、実行前にエージェントのツール利用を制限します。
- 使いどころ
- エージェントがデータベース、ファイルシステム、シェルコマンド、外部 API といった重要なシステムを操作し、誤用が実害につながる場合。
- 注意点
- 制限が厳しすぎると正当な作業を妨げ、緩すぎると執拗なプロンプトインジェクション攻撃を止められません。
このパターンについてAIエキスパートに質問
質問が入力済みの状態でアシスタントが開きます。送信前に内容を確認できます。
ツール悪用防止パターン: 概要
エージェントが操作され、ツールを通じて悪意ある操作を実行させられるのを防ぐ
- Tool permission boundaries
- Action validation before execution
- Sandbox environments for tools
- Comprehensive audit logging
- Rate limiting per tool type
- Capability-based access control
The Agent Architect
1つのパターン、1つのトレードオフ、1つの本番障害事例。エージェントシステムを構築する人のための短い週刊ブリーフィング。
週1回のメール、ワンクリックで購読解除できます。アドレスはブリーフィングの送信のみに使用します。
参考文献
このパターンの根拠となる論文、仕様、リポジトリです。
- OWASP ASI (2025)
- NIST AI 600-1
このカタログを作ったエンジニアが担当
あなたのエージェントシステムをレッドチーミング
ここで説明した対策は、誰かが破ろうとして初めて確かめられます。実際の攻撃者と同じ手口で検証します。プロンプトインジェクション、ジェイルブレイク、ツールの悪用、データ持ち出しまで、すべての指摘に修正方法を添えます。
€750(通常€1,500)・1週間・文書レポートとウォークスルーコール・9月30日まで