验证链(Chain-of-Verification):先答再查
大模型的幻觉常来自「不假思索地顺口答」。验证链(Chain-of-Verification,CoVe)让模型先给出回答,再主动核查并修正。它把「一次回答」变成「回答加质检」的过程,是降低事实错误的有效手段。
四步流程
- 第一步 起草:让模型基于已知信息给出初步回答。
- 第二步 计划验证:让模型列出回答里「值得核实的要点」,例如具体数字、日期、因果论断。
- 第三步 逐条验证:让模型针对每个要点独立核查,不受原回答干扰。
- 第四步 修正:比对验证结果,改写或补充原回答,标注无法确认的部分。
关键技巧
- 验证要「独立」:让模型单独回答核查问题,而不是直接问「你刚才说的对吗」,否则容易自我确认。
- 区分类型:事实性内容值得验证,主观观点不需要。
- 给核查工具:在 Agent 场景接入检索或工具,验证效果远好于纯自问自答。
适合与不适合
- 适合:需要事实准确的问答、摘要、资料整理、报告初稿。
- 不适合:创意写作、头脑风暴,验证会拖慢节奏且收益小。
与自反思的区别
- Self-Refine 是「写后自我批评」,偏质量和逻辑。
- CoVe 是「写后逐条核实」,偏事实准确性。
- 二者可叠加:先 CoVe 核事实,再 Self-Refine 打磨表达。
小结
验证链用「先答再查再改」降低幻觉,关键是让核查与原始回答相互独立。在事实密集型任务里,这是投入最小、收益最明显的提示策略之一。
参考与延伸阅读
- Chain-of-Verification Reduces Hallucination in Large Language Models(已核验,ACL 2024)
- 本站「自反思提示(Self-Refine)」与「提示调试」教程
本文累计阅读 — 次