正在加载模式…
结构化反思(Think Tool)
在智能体的工具 schema 中声明的一个专用、无副作用的“think”工具(Anthropic),模型在轨迹中途调用它,以在工具结果与下一步行动之间追加结构化推理。该调用没有任何外部效果,也不返回任何有用的内容:它只是为模型提供一个检查点,以便在一条很长的工具调用链中行动之前重新阅读策略、核对约束并进行规划。Anthropic 报告称,当把该工具与一段展示其用法的提示词搭配使用时,在 tau-bench 的 pass^1 airline 指标上取得了 54% 的相对提升(0.570,而基线为 0.370)。它不同于 `metacognitive-monitoring`:后者指的是监控自身推理的通用能力,而 think 工具是实现这一能力的一种具体的工具 schema 层面的机制,与在首次响应之前进行的扩展思考或推理时思考不同。
30秒速览
- 是什么
- 在 schema 中声明一个空操作工具,模型在执行过程中调用它,以便暂停、重读策略,并规划下一步动作。
- 何时使用
- 在做出不可逆动作之前,模型必须核实约束或策略合规性的长工具调用链。
- 注意
- 如果提示中的示例薄弱或缺失,模型可能根本不去调用 think;其效果完全取决于你是否向模型展示了何时以及如何使用它。
向AI专家咨询此模式
打开助手并预填您的问题,发送前可先确认。
结构化反思(Think Tool): 概览
在智能体的工具 schema 中声明的一个专用、无副作用的“think”工具(Anthropic),模型在轨迹中途调用它,以在工具结果与下一步行动之间追加结构化推理。该调用没有任何外部效果,也不返回任何有用的内容:它只是为模型提供一个检查点,以便在一条很长的工具调用链中行动之前重新阅读策略、核对约束并进行规划。Anthropic 报告称,当把该工具与一段展示其用法的提示词搭配使用时,在 tau-bench 的 pass^1 airline 指标上取得了 54% 的相对提升(0.570,而基线为 0.370)。它不同于 `metacognitive-monitoring`:后者指的是监控自身推理的通用能力,而 think 工具是实现这一能力的一种具体的工具 schema 层面的机制,与在首次响应之前进行的扩展思考或推理时思考不同。
- No-op tool in the schema: no side effect and no new data returned
- Called mid-trajectory, between a tool result and the next action
- Creates explicit reflection checkpoints inside long tool-call chains
- Used to re-check policy compliance and validate plans before acting
- Cheap and low-code: one tool definition plus a usage-guiding prompt
- Reported 54% relative pass^1 gain on the tau-bench airline domain
The Agent Architect
每周一个模式、一个权衡、一个生产事故案例。为构建智能体系统的人准备的每周简报。
每周一封邮件,一键退订。您的地址仅用于发送简报。
参考资料
该模式所依据的论文、规范和代码仓库。
由本目录背后的工程师执行
为你的智能体架构做一次评审
本页讲的是一个模式。真实系统会同时跑几十个,而多数故障恰恰出在它们的衔接处。我们按本目录的 288 个模式评审你的整体设计:架构、可靠性、评测与成本,每一条结论都对应到能修复它的模式。
€750(原价 €1,500),一周交付,书面报告加讲解通话,9月30日前