正在加载模式…
🔎
验证链(Chain of Verification,CoVe)
先起草一个基线答案,再围绕它规划一组验证问题,并独立地回答每个问题,使核查不受草稿的影响,然后仅使用经过验证的事实来修订最终答案,从而减少幻觉。将核查放在独立上下文中运行的因子化验证,效果优于让模型重新检查自己的草稿,因为后者往往会重复自身的错误。
复杂度: medium推理技术
30秒速览
- 是什么
- 先起草答案,再针对它生成核查问题,在看不到草稿的情况下独立回答每个问题,最后只用经过核实的事实修订答案。
- 何时使用
- 容易产生幻觉的事实性任务,其中的论断可以拆解为可核查的问题,并且能接受适度的延迟开销。
- 注意
- 如果核查问题设计不当,就会继承草稿中的错误;独立作答会让成本和延迟增加到 2 至 3 倍。
向AI专家咨询此模式
打开助手并预填您的问题,发送前可先确认。
验证链(Chain of Verification,CoVe): 概览
先起草一个基线答案,再围绕它规划一组验证问题,并独立地回答每个问题,使核查不受草稿的影响,然后仅使用经过验证的事实来修订最终答案,从而减少幻觉。将核查放在独立上下文中运行的因子化验证,效果优于让模型重新检查自己的草稿,因为后者往往会重复自身的错误。
- Generates a baseline draft answer first
- Plans targeted verification questions about the draft
- Answers each verification question independently of the draft
- Factored execution stops the draft from biasing its own checks
- Revises the final answer to drop unverified claims
- Cuts hallucination on list-based and closed-book factual tasks
The Agent Architect
每周一个模式、一个权衡、一个生产事故案例。为构建智能体系统的人准备的每周简报。
每周一封邮件,一键退订。您的地址仅用于发送简报。
参考资料
该模式所依据的论文、规范和代码仓库。
- Chain-of-Verification Reduces Hallucination in Large Language Models - Dhuliawala et al. (ArXiv 2023)arXiv:2309.11495
- Chain-of-Verification (CoVe), Meta AI - Findings of ACL 2024
由本目录背后的工程师执行
为你的智能体架构做一次评审
本页讲的是一个模式。真实系统会同时跑几十个,而多数故障恰恰出在它们的衔接处。我们按本目录的 288 个模式评审你的整体设计:架构、可靠性、评测与成本,每一条结论都对应到能修复它的模式。
€750(原价 €1,500),一周交付,书面报告加讲解通话,9月30日前