VALIDATED CHAIN · cot-critic-chain

CoT + Critic 验证链

深度推理链(Chain of Thought)+ 批判者角色自我验证,用于高风险/高精度推理任务

协议 URL:https://xmind.lute-tlz-dddd.top/combinations/cot-critic-chain.html

01

组合定义

深度推理链(Chain of Thought)+ 批判者角色自我验证,用于高风险/高精度推理任务

02

适用问题

问题类型

  • 复杂逻辑推理
  • 多步骤分析
  • 需要自我验证的结论
  • 容错率低的决策

触发信号

  • 推理步骤多于3步,容易出现中间错误
  • 结论需要高置信度,错误代价大
  • 需要区分事实和推断
03

不适用与停止条件

以下边界直接来自已验证阶段的检查点与停止条件;任一阶段无法验证时,不应继续推进。

阶段检查点

  • 问题分解(Decompose):将问题分解为互斥完整的子问题。每个子问题必须:1) 独立可解 2) 有明确答案格式 3) 按依赖关系排序
  • 逐步推理(Chain-of-Thought):对每个子问题进行深度推理。每步必须:1) 声明使用的推理规则 2) 区分「事实」和「推断」3) 给出置信度(高/中/低)
  • 批判审查(Critic):扮演严格的批判者,审查推理链。检查:1) 有没有逻辑跳跃?2) 关键假设是否成立?3) 有没有反例?4) 置信度低的步骤是否影响结论?
  • 修正推理(Revise):根据 Critic 的报告修正推理。对每个被标注的问题:1) 承认原推理的问题 2) 重新推导 3) 说明修正了什么
  • 验证综合(Verify & Synthesize):综合验证后的推理链,输出最终结论。必须:1) 列出最终依赖的关键假设 2) 整体置信度评估 3) 结论的适用边界

阶段停止条件

  • 问题分解(Decompose):所有子问题合起来完整覆盖原问题
  • 逐步推理(Chain-of-Thought):所有子问题有推理结论
  • 批判审查(Critic):没有严重问题 OR 所有严重问题已标注
  • 修正推理(Revise):所有严重问题已被修复
  • 验证综合(Verify & Synthesize):输出完整

站点规则:医疗、法律、财务或紧急风险问题须交由当地合格专业人士处理。

04

使用前需要提供的输入

输入合同按阶段顺序汇总全部唯一阶段输入;后续阶段可由前序输出交接补齐。

  • 问题分解(Decompose):原始复杂问题
  • 逐步推理(Chain-of-Thought):子问题 + 已知信息
  • 批判审查(Critic):Phase 2 的完整推理链
  • 修正推理(Revise):Phase 2 推理链 + Phase 3 批判报告
  • 验证综合(Verify & Synthesize):修正后的推理链

开始前请区分已知事实、仍待验证的假设和明确约束。

05

有序阶段

  1. PHASE 01

    问题分解(Decompose)

    角色:任务分解
    输入
    原始复杂问题
    输出
    子问题树:{子问题列表, 依赖关系, 求解顺序}
    检查点
    将问题分解为互斥完整的子问题。每个子问题必须:1) 独立可解 2) 有明确答案格式 3) 按依赖关系排序
    停止条件
    所有子问题合起来完整覆盖原问题
  2. PHASE 02

    逐步推理(Chain-of-Thought)

    角色:逻辑分析
    输入
    子问题 + 已知信息
    输出
    推理链:每步格式 = {规则, 应用, 结论, 置信度, 依赖假设}
    检查点
    对每个子问题进行深度推理。每步必须:1) 声明使用的推理规则 2) 区分「事实」和「推断」3) 给出置信度(高/中/低)
    停止条件
    所有子问题有推理结论
  3. PHASE 03

    批判审查(Critic)

    角色:假设检验
    输入
    Phase 2 的完整推理链
    输出
    批判报告:{发现的问题列表, 每个问题的严重程度, 修复建议}
    检查点
    扮演严格的批判者,审查推理链。检查:1) 有没有逻辑跳跃?2) 关键假设是否成立?3) 有没有反例?4) 置信度低的步骤是否影响结论?
    停止条件
    没有严重问题 OR 所有严重问题已标注
  4. PHASE 04

    修正推理(Revise)

    角色:第一性原理
    输入
    Phase 2 推理链 + Phase 3 批判报告
    输出
    修正后的推理链(标注哪些步骤被修改)
    检查点
    根据 Critic 的报告修正推理。对每个被标注的问题:1) 承认原推理的问题 2) 重新推导 3) 说明修正了什么
    停止条件
    所有严重问题已被修复

    未通过时回到「批判审查(Critic)」

  5. PHASE 05

    验证综合(Verify & Synthesize)

    角色:观察反思
    输入
    修正后的推理链
    输出
    最终结论:{核心答案, 关键假设, 整体置信度, 适用边界, 无效场景}
    检查点
    综合验证后的推理链,输出最终结论。必须:1) 列出最终依赖的关键假设 2) 整体置信度评估 3) 结论的适用边界
    停止条件
    输出完整
06

回退与循环

07

替代模型与替换边界

当前协议只发布经验证的稳定模型 ID。替换模型必须继续满足本阶段角色、输入、输出、检查点和停止条件,并重新通过交叉引用验证;不得按显示名称猜测替换。

08

复合 Prompt

由已验证阶段协议在构建时编排;不是源 JSON 的独立字段。

以下复合 Prompt 由已验证阶段协议在构建时编排。请按「CoT + Critic 验证链」执行组合协议。
定义:深度推理链(Chain of Thought)+ 批判者角色自我验证,用于高风险/高精度推理任务
Agent 流程:CoT-with-Critic
适用问题:复杂逻辑推理;多步骤分析;需要自我验证的结论;容错率低的决策
触发信号:推理步骤多于3步,容易出现中间错误;结论需要高置信度,错误代价大;需要区分事实和推断
开始前输入:原始复杂问题

严格按以下顺序执行;每阶段都要交付输出、核对检查点,并遵守停止条件:
1. 问题分解(Decompose) [角色:任务分解]
   输入:原始复杂问题
   输出:子问题树:{子问题列表, 依赖关系, 求解顺序}
   检查点:将问题分解为互斥完整的子问题。每个子问题必须:1) 独立可解 2) 有明确答案格式 3) 按依赖关系排序
   停止条件:所有子问题合起来完整覆盖原问题
   回环:无
2. 逐步推理(Chain-of-Thought) [角色:逻辑分析]
   输入:子问题 + 已知信息
   输出:推理链:每步格式 = {规则, 应用, 结论, 置信度, 依赖假设}
   检查点:对每个子问题进行深度推理。每步必须:1) 声明使用的推理规则 2) 区分「事实」和「推断」3) 给出置信度(高/中/低)
   停止条件:所有子问题有推理结论
   回环:无
3. 批判审查(Critic) [角色:假设检验]
   输入:Phase 2 的完整推理链
   输出:批判报告:{发现的问题列表, 每个问题的严重程度, 修复建议}
   检查点:扮演严格的批判者,审查推理链。检查:1) 有没有逻辑跳跃?2) 关键假设是否成立?3) 有没有反例?4) 置信度低的步骤是否影响结论?
   停止条件:没有严重问题 OR 所有严重问题已标注
   回环:无
4. 修正推理(Revise) [角色:第一性原理]
   输入:Phase 2 推理链 + Phase 3 批判报告
   输出:修正后的推理链(标注哪些步骤被修改)
   检查点:根据 Critic 的报告修正推理。对每个被标注的问题:1) 承认原推理的问题 2) 重新推导 3) 说明修正了什么
   停止条件:所有严重问题已被修复
   回环:未通过时回到 批判审查(Critic)
5. 验证综合(Verify & Synthesize) [角色:观察反思]
   输入:修正后的推理链
   输出:最终结论:{核心答案, 关键假设, 整体置信度, 适用边界, 无效场景}
   检查点:综合验证后的推理链,输出最终结论。必须:1) 列出最终依赖的关键假设 2) 整体置信度评估 3) 结论的适用边界
   停止条件:输出完整
   回环:无

边界:明确区分事实、假设与推断;无法验证的内容须标记,不得用本协议替代医疗、法律或财务专业判断。
09

事实、假设与专业升级

组合协议用于组织推理,不代表事实已经成立。每个阶段都要标记事实、假设与推断;医疗、法律、财务或紧急风险问题应交由当地合格专业人士处理。