模式矩阵 /模式白皮书/Reasoning
ADPS Agent 设计模式白皮书 · 模块总纲
推理模块 · 把证据编译成可检查的判断
推理产物、深度路由、并行探索、假设验证、实时交互与工程验收。
推理位于感知、记忆与行动之间。感知提供当前信号,记忆取回过去的事实与经验;推理据此形成判断,行动再决定怎样改变外部环境。
生产系统还要保存判断记录:证据引用、候选方案、不确定性、预算消耗、验证办法和下一步。后续模块据此复核、拒绝或执行这项判断。
推理的输出边界
“建议批准”只是一句结论。可交给下游系统的推理产物需要说明这项结论依据什么、在哪些条件下成立、还缺什么,以及谁有资格执行后续动作。
decision_id: dec_01K...
goal_ref: goal://incident/482
evidence_refs:
- log://gateway/482#timeout
- change://config/917
choice: rollback_recent_configuration
alternatives:
- keep_observing
- isolate_single_instance
uncertainty:
level: medium
unresolved: database latency has not been excluded
validation:
before_action: reproduce on canary
after_action: error rate returns to baseline
authority:
required: on_call_approval
next_action: prepare_rollback_intent
这份记录仍是判断,不是执行指令。行动模块需要重新检查权限、工具、参数、现实状态和验收条件。
模式职责
| 模式 | 描述范围 | 关键产物 |
|---|---|---|
| R1 思维链 | 按顺序形成判断,并管理接口允许保留的摘要、依据和模型元数据 | 推理摘要、证据绑定、决策记录 |
| R2 复杂度路由 | 根据任务难度、风险、证据缺口和服务目标选择模型、推理深度与回退路径 | RouteDecision、预算与降级规则 |
| R3 并行探索 | 为同一问题启动相互隔离的候选路径,再按错误代价聚合 | 分支结果、分歧记录、聚合结论 |
| R4 迭代假设验证 | 用新证据更新假设,直到收敛、预算耗尽或转交人工 | 假设树、反证、退出原因 |
| R5 双模架构 | 把低延迟交互与高成本分析放在不同职责中,通过结构化状态交接 | 任务包、共享状态、推理结果包 |
复杂度与风险分别判断
问题很难,不一定允许花更多权限解决;问题很短,也可能触发高风险动作。路由器应分别计算推理难度和业务风险,再确定模型档位、并行数量、时间预算和人工边界。
| 低风险 | 高风险 | |
|---|---|---|
| 低难度 | 规则或轻量模型;结果可快速复验 | 计算可以简单,证据与审批仍需收紧 |
| 高难度 | 深度推理或并行探索;限制成本与时延 | 深度推理、独立验证、明确人审和停止条件 |
模式可以嵌套
一次生产故障诊断可以先由 R2 判断复杂度和风险。常见低风险问题进入 R1;证据冲突时启动 R3,让不同分支独立分析;根因仍不清楚时,R4 按“假设—取证—证伪”循环推进。用户等待期间,R5 的交互者说明进度,推理者在后台继续分析。
组合设计需要一个明确的收口位置。它负责等待必要分支、处理超时和冲突、检查退出条件,并把结果压成同一种决策结构。缺少收口规则时,增加分支只会增加答案数量。
预算、退出与升级
| 控制项 | 需要回答的问题 |
|---|---|
| 预算 | 允许多少 token、模型调用、并发、时延和外部检索? |
| 证据 | 哪些结论必须绑定外部事实?证据是否仍在有效期内? |
| 分歧 | 多数票、任一路告警和独立裁判分别适用于什么错误代价? |
| 退出 | 证据充分、候选无法区分、预算耗尽和用户改题时怎样停止? |
| 升级 | 移交人工时要携带哪些假设、证据、已排除路径和待决问题? |
与相邻模块的接口
| 模块 | 交给推理的内容 | 从推理接收的内容 |
|---|---|---|
| 感知 | 当前信号、来源、时间与解析结果 | 补充观测或澄清请求 |
| 记忆 | 带版本和作用域的事实、经验与进度 | 可发布的决策摘要与适用边界 |
| 行动 | 工具结果、业务回执与最新状态 | 结构化判断,不直接继承执行权限 |
| 反思 | 评测结果、失败归因与延迟反馈 | 本轮决策记录和可复验条件 |
| 治理 | 权限、预算、禁区与人审要求 | 风险声明、待批准意图与证据 |
验证指标
- 判断质量:在业务评测集上统计正确率、漏报、误报和校准误差。
- 路由质量:比较实际路径与可接受的最低成本路径,记录误降级和不必要升档。
- 收敛质量:统计假设被证伪的效率、超限退出、人工升级和重复取证。
- 运行代价:同时报告质量、时延、token、并发和外部工具成本。
- 可复核性:检查关键结论是否能够回到证据、版本、规则和责任主体。
公开模式
建议引用:ADPS,《推理模块:把证据编译成可检查的判断》,Agent 设计模式白皮书,2026。
范围:本页定义模块边界与工程检查项,不认证具体模型、产品或企业实现。场景用于说明模式组合;具名案例以蓝皮书页面的证据说明为准。
溯源记录
- 来源记录
- 推理模块第一次研讨会(2026-08-26);ADPS 推理模式公开规范
- 来源日期
- 本页首次公开