正在加载模式…
元认知监控(MCM)
对推理质量与置信度的自我觉察和监控
30秒速览
- 是什么
- 智能体跟踪自身推理质量、置信水平和知识缺口,然后基于自我评估调整策略或请求澄清。
- 何时使用
- 高风险决策场景:错误答案会造成真实伤害,而中途的置信度检查可以触发补充数据收集或专家复核。
- 注意
- 置信度估计常常与实际准确率相关性很差;过度自信的智能体尽管自报确定性很高,却会跳过必要的验证步骤。
向AI专家咨询此模式
打开助手并预填您的问题,发送前可先确认。
元认知监控: 概览
对推理质量与置信度的自我觉察和监控
- Reasoning quality assessment
- Confidence estimation
- Knowledge gap detection
- Strategy effectiveness monitoring
- Adaptive reasoning adjustment
- Error anticipation
The Agent Architect
每周一个模式、一个权衡、一个生产事故案例。为构建智能体系统的人准备的每周简报。
每周一封邮件,一键退订。您的地址仅用于发送简报。
参考资料
该模式所依据的论文、规范和代码仓库。
- Teaching Large Language Models to Self-Debug (Chen et al., 2023)arXiv:2304.05128
- Self-Refine: Iterative Refinement with Self-Feedback (Madaan et al., 2023)arXiv:2303.17651
- Constitutional AI: Harmlessness from AI Feedback (Bai et al., 2022)arXiv:2212.08073
- LangChain Self-Correction Patterns
- DSPy Official Documentation
由本目录背后的工程师执行
为你的智能体架构做一次评审
本页讲的是一个模式。真实系统会同时跑几十个,而多数故障恰恰出在它们的衔接处。我们按本目录的 288 个模式评审你的整体设计:架构、可靠性、评测与成本,每一条结论都对应到能修复它的模式。
€750(原价 €1,500),一周交付,书面报告加讲解通话,9月30日前