VALIDATED CHAIN · cot-critic-chain
CoT + Critic 验证链
深度推理链(Chain of Thought)+ 批判者角色自我验证,用于高风险/高精度推理任务
协议 URL:https://xmind.lute-tlz-dddd.top/combinations/cot-critic-chain.html
01
组合定义
深度推理链(Chain of Thought)+ 批判者角色自我验证,用于高风险/高精度推理任务
02
适用问题
问题类型
- 复杂逻辑推理
- 多步骤分析
- 需要自我验证的结论
- 容错率低的决策
触发信号
- 推理步骤多于3步,容易出现中间错误
- 结论需要高置信度,错误代价大
- 需要区分事实和推断
03
不适用与停止条件
以下边界直接来自已验证阶段的检查点与停止条件;任一阶段无法验证时,不应继续推进。
阶段检查点
- 问题分解(Decompose):将问题分解为互斥完整的子问题。每个子问题必须:1) 独立可解 2) 有明确答案格式 3) 按依赖关系排序
- 逐步推理(Chain-of-Thought):对每个子问题进行深度推理。每步必须:1) 声明使用的推理规则 2) 区分「事实」和「推断」3) 给出置信度(高/中/低)
- 批判审查(Critic):扮演严格的批判者,审查推理链。检查:1) 有没有逻辑跳跃?2) 关键假设是否成立?3) 有没有反例?4) 置信度低的步骤是否影响结论?
- 修正推理(Revise):根据 Critic 的报告修正推理。对每个被标注的问题:1) 承认原推理的问题 2) 重新推导 3) 说明修正了什么
- 验证综合(Verify & Synthesize):综合验证后的推理链,输出最终结论。必须:1) 列出最终依赖的关键假设 2) 整体置信度评估 3) 结论的适用边界
阶段停止条件
- 问题分解(Decompose):所有子问题合起来完整覆盖原问题
- 逐步推理(Chain-of-Thought):所有子问题有推理结论
- 批判审查(Critic):没有严重问题 OR 所有严重问题已标注
- 修正推理(Revise):所有严重问题已被修复
- 验证综合(Verify & Synthesize):输出完整
站点规则:医疗、法律、财务或紧急风险问题须交由当地合格专业人士处理。
04
使用前需要提供的输入
输入合同按阶段顺序汇总全部唯一阶段输入;后续阶段可由前序输出交接补齐。
- 问题分解(Decompose):原始复杂问题
- 逐步推理(Chain-of-Thought):子问题 + 已知信息
- 批判审查(Critic):Phase 2 的完整推理链
- 修正推理(Revise):Phase 2 推理链 + Phase 3 批判报告
- 验证综合(Verify & Synthesize):修正后的推理链
开始前请区分已知事实、仍待验证的假设和明确约束。
05
有序阶段
PHASE 01
问题分解(Decompose)
角色:任务分解- 输入
- 原始复杂问题
- 输出
- 子问题树:{子问题列表, 依赖关系, 求解顺序}
- 检查点
- 将问题分解为互斥完整的子问题。每个子问题必须:1) 独立可解 2) 有明确答案格式 3) 按依赖关系排序
- 停止条件
- 所有子问题合起来完整覆盖原问题
PHASE 02
逐步推理(Chain-of-Thought)
角色:逻辑分析- 输入
- 子问题 + 已知信息
- 输出
- 推理链:每步格式 = {规则, 应用, 结论, 置信度, 依赖假设}
- 检查点
- 对每个子问题进行深度推理。每步必须:1) 声明使用的推理规则 2) 区分「事实」和「推断」3) 给出置信度(高/中/低)
- 停止条件
- 所有子问题有推理结论
PHASE 03
批判审查(Critic)
角色:假设检验- 输入
- Phase 2 的完整推理链
- 输出
- 批判报告:{发现的问题列表, 每个问题的严重程度, 修复建议}
- 检查点
- 扮演严格的批判者,审查推理链。检查:1) 有没有逻辑跳跃?2) 关键假设是否成立?3) 有没有反例?4) 置信度低的步骤是否影响结论?
- 停止条件
- 没有严重问题 OR 所有严重问题已标注
PHASE 04
修正推理(Revise)
角色:第一性原理- 输入
- Phase 2 推理链 + Phase 3 批判报告
- 输出
- 修正后的推理链(标注哪些步骤被修改)
- 检查点
- 根据 Critic 的报告修正推理。对每个被标注的问题:1) 承认原推理的问题 2) 重新推导 3) 说明修正了什么
- 停止条件
- 所有严重问题已被修复
PHASE 05
验证综合(Verify & Synthesize)
角色:观察反思- 输入
- 修正后的推理链
- 输出
- 最终结论:{核心答案, 关键假设, 整体置信度, 适用边界, 无效场景}
- 检查点
- 综合验证后的推理链,输出最终结论。必须:1) 列出最终依赖的关键假设 2) 整体置信度评估 3) 结论的适用边界
- 停止条件
- 输出完整
06
回退与循环
07
替代模型与替换边界
当前协议只发布经验证的稳定模型 ID。替换模型必须继续满足本阶段角色、输入、输出、检查点和停止条件,并重新通过交叉引用验证;不得按显示名称猜测替换。
08
复合 Prompt
由已验证阶段协议在构建时编排;不是源 JSON 的独立字段。
以下复合 Prompt 由已验证阶段协议在构建时编排。请按「CoT + Critic 验证链」执行组合协议。
定义:深度推理链(Chain of Thought)+ 批判者角色自我验证,用于高风险/高精度推理任务
Agent 流程:CoT-with-Critic
适用问题:复杂逻辑推理;多步骤分析;需要自我验证的结论;容错率低的决策
触发信号:推理步骤多于3步,容易出现中间错误;结论需要高置信度,错误代价大;需要区分事实和推断
开始前输入:原始复杂问题
严格按以下顺序执行;每阶段都要交付输出、核对检查点,并遵守停止条件:
1. 问题分解(Decompose) [角色:任务分解]
输入:原始复杂问题
输出:子问题树:{子问题列表, 依赖关系, 求解顺序}
检查点:将问题分解为互斥完整的子问题。每个子问题必须:1) 独立可解 2) 有明确答案格式 3) 按依赖关系排序
停止条件:所有子问题合起来完整覆盖原问题
回环:无
2. 逐步推理(Chain-of-Thought) [角色:逻辑分析]
输入:子问题 + 已知信息
输出:推理链:每步格式 = {规则, 应用, 结论, 置信度, 依赖假设}
检查点:对每个子问题进行深度推理。每步必须:1) 声明使用的推理规则 2) 区分「事实」和「推断」3) 给出置信度(高/中/低)
停止条件:所有子问题有推理结论
回环:无
3. 批判审查(Critic) [角色:假设检验]
输入:Phase 2 的完整推理链
输出:批判报告:{发现的问题列表, 每个问题的严重程度, 修复建议}
检查点:扮演严格的批判者,审查推理链。检查:1) 有没有逻辑跳跃?2) 关键假设是否成立?3) 有没有反例?4) 置信度低的步骤是否影响结论?
停止条件:没有严重问题 OR 所有严重问题已标注
回环:无
4. 修正推理(Revise) [角色:第一性原理]
输入:Phase 2 推理链 + Phase 3 批判报告
输出:修正后的推理链(标注哪些步骤被修改)
检查点:根据 Critic 的报告修正推理。对每个被标注的问题:1) 承认原推理的问题 2) 重新推导 3) 说明修正了什么
停止条件:所有严重问题已被修复
回环:未通过时回到 批判审查(Critic)
5. 验证综合(Verify & Synthesize) [角色:观察反思]
输入:修正后的推理链
输出:最终结论:{核心答案, 关键假设, 整体置信度, 适用边界, 无效场景}
检查点:综合验证后的推理链,输出最终结论。必须:1) 列出最终依赖的关键假设 2) 整体置信度评估 3) 结论的适用边界
停止条件:输出完整
回环:无
边界:明确区分事实、假设与推断;无法验证的内容须标记,不得用本协议替代医疗、法律或财务专业判断。09
事实、假设与专业升级
组合协议用于组织推理,不代表事实已经成立。每个阶段都要标记事实、假设与推断;医疗、法律、财务或紧急风险问题应交由当地合格专业人士处理。