反思提示:让模型自我纠错

反思(reflection)提示在模型给出初稿后,引导它回顾自己的推理与结论,找出错误并产出修正版本,形成「生成到检查到改进」的闭环。它特别适合答案一旦出错代价较高的场景,如代码、数学与事实问答。

是什么

反思不是一次性问答,而是两阶段或多阶段流程:先得出结果,再用一个明确的检查指令让模型质疑自己,例如「请检查上面的回答是否存在事实错误或逻辑漏洞」。

为什么有效

大模型的首答可能因忽略约束或事实而带错。显式要求自我复核,能把隐含的校验步骤外显,显著减少低级错误与前后矛盾。

怎么做

可以在同一对话里追加反思指令,也可以把初稿作为上下文重新提交。

第一步:回答下面的问题。
第二步:以严格评审身份检查你的回答,列出可能的事实或逻辑错误。
第三步:根据检查给出最终修订版。
问题:……

注意点

  • 反思会增加 token 消耗与延迟,仅在错误成本高的任务使用。
  • 模型也可能「反思」出假问题,最终版仍需人工抽检。
  • 论文 Reflexion 把反思写入记忆循环,适合可反复试错的 Agent 场景。

小结

反思提示用「生成、检查、修订」的闭环把校验显式化,能降低错误与矛盾。它以增加成本为代价,适合高错误代价或 Agent 反复试错的场景。

参考与延伸阅读

本文累计阅读