验证链(Chain-of-Verification):先答再查

大模型的幻觉常来自「不假思索地顺口答」。验证链(Chain-of-Verification,CoVe)让模型先给出回答,再主动核查并修正。它把「一次回答」变成「回答加质检」的过程,是降低事实错误的有效手段。

四步流程

  • 第一步 起草:让模型基于已知信息给出初步回答。
  • 第二步 计划验证:让模型列出回答里「值得核实的要点」,例如具体数字、日期、因果论断。
  • 第三步 逐条验证:让模型针对每个要点独立核查,不受原回答干扰。
  • 第四步 修正:比对验证结果,改写或补充原回答,标注无法确认的部分。

关键技巧

  • 验证要「独立」:让模型单独回答核查问题,而不是直接问「你刚才说的对吗」,否则容易自我确认。
  • 区分类型:事实性内容值得验证,主观观点不需要。
  • 给核查工具:在 Agent 场景接入检索或工具,验证效果远好于纯自问自答。

适合与不适合

  • 适合:需要事实准确的问答、摘要、资料整理、报告初稿。
  • 不适合:创意写作、头脑风暴,验证会拖慢节奏且收益小。

与自反思的区别

  • Self-Refine 是「写后自我批评」,偏质量和逻辑。
  • CoVe 是「写后逐条核实」,偏事实准确性。
  • 二者可叠加:先 CoVe 核事实,再 Self-Refine 打磨表达。

小结

验证链用「先答再查再改」降低幻觉,关键是让核查与原始回答相互独立。在事实密集型任务里,这是投入最小、收益最明显的提示策略之一。

参考与延伸阅读

  • Chain-of-Verification Reduces Hallucination in Large Language Models(已核验,ACL 2024)
  • 本站「自反思提示(Self-Refine)」与「提示调试」教程
本文累计阅读