正在加载模式…
🗳️
自洽性(SC)
在非零温度下采样多条不同的思维链路径,然后通过多数投票或置信度加权投票聚合它们的最终答案。由于正确答案往往能通过多条不同的推理路径得出,而个别错误则各自分散,因此共识答案远比任何单次贪心解码更可靠。
复杂度: medium推理技术
30秒速览
- 是什么
- 在非零温度下采样多条推理路径,然后通过多数投票或置信度加权选出最终答案。
- 何时使用
- 答案正确性可验证的问题,存在多条不同的推理路径,且错误会分散在各次采样之间。
- 注意
- 推理成本会变成 N 倍;如果大多数路径收敛到同一个错误答案,多数投票就会失效。
向AI专家咨询此模式
打开助手并预填您的问题,发送前可先确认。
自洽性: 概览
在非零温度下采样多条不同的思维链路径,然后通过多数投票或置信度加权投票聚合它们的最终答案。由于正确答案往往能通过多条不同的推理路径得出,而个别错误则各自分散,因此共识答案远比任何单次贪心解码更可靠。
- Samples N independent reasoning paths at nonzero temperature
- Marginalizes over reasoning by voting on final answers only
- Majority or confidence-weighted aggregation of candidates
- Correct answers converge while sporadic errors are outvoted
- Foundation of best-of-N test-time compute scaling
- Universal Self-Consistency extends voting to free-form outputs
The Agent Architect
每周一个模式、一个权衡、一个生产事故案例。为构建智能体系统的人准备的每周简报。
每周一封邮件,一键退订。您的地址仅用于发送简报。
参考资料
该模式所依据的论文、规范和代码仓库。
由本目录背后的工程师执行
为你的智能体架构做一次评审
本页讲的是一个模式。真实系统会同时跑几十个,而多数故障恰恰出在它们的衔接处。我们按本目录的 288 个模式评审你的整体设计:架构、可靠性、评测与成本,每一条结论都对应到能修复它的模式。
€750(原价 €1,500),一周交付,书面报告加讲解通话,9月30日前