Loading...
構造化リフレクション(Think Tool)
エージェントのツールスキーマに宣言される、専用で副作用のない「think」ツール(Anthropic)です。モデルは軌道の途中でこれを呼び出し、ツールの結果と次の行動との間に構造化された推論を追加します。この呼び出しは外部への影響を持たず、有用な値も返しません。つまり、長いツール呼び出しの連鎖の中で行動する前に、ポリシーを読み直し、制約を検証し、計画を立てるためのチェックポイントをモデルに与えるだけです。Anthropicは、このツールを使い方を示すプロンプトと組み合わせた場合、tau-benchのpass^1 airlineメトリクスで54%の相対的改善(ベースラインの0.370に対して0.570)が得られたと報告しています。これは`metacognitive-monitoring`とは異なります。すなわち、あの項目は自らの推論を監視する一般的な能力を指すのに対し、think toolはそのための具体的なツールスキーマ上の仕組みであり、最初の応答の前に行われる拡張思考や推論時の思考とは別物です。
In 30 seconds
- What
- スキーマ上に何も実行しないツールを宣言し、モデルが処理の途中でそれを呼び出すことで、いったん立ち止まってポリシーを読み直し、次の行動を計画できるようにします。
- When to use
- 取り消せない行動に踏み切る前に、モデルが制約やポリシーへの適合を確認しなければならない、長いツール呼び出しの連鎖。
- Watch out
- プロンプト内の例が弱かったり存在しなかったりすると、モデルは think の呼び出しを省いてしまう可能性があります。効果は、いつどのように使うかをモデルに示せるかどうかに完全に依存します。
Loading technique guide…