模式目录/横切工程面/X1

ADPS 横切工程面规范

X1 · Observability · 可观测性

以事件、因果、版本、状态差异和外部回执建立 Agent 证据链。

X1 用统一事件、因果标识、版本引用、状态差异和外部回执,把一次运行组织成可以查询、评测和归因的证据链。

位置

可观测性贯穿七个认知功能、六种执行拓扑和完整生命周期,不占用双轴矩阵格位。旧编号 G4 仅作为历史入口保留,当前规范编号为 X1。

从日志到证据

观察面需要保留的事实用途
输入与上下文来源、版本、准入和丢弃原因还原 Agent 当时能看到什么
决策与计划目标、步骤、路由、候选和裁决摘要分析漂移、路由和计划错误
动作与控制工具、参数来源、身份、策略、审批和配额审计与调用级归因
状态与结果状态差异、外部回执、业务验收与人工修订识别假成功和真实影响
运行基础模型、提示词、Skill、知识、工具和策略版本版本比较与回归定位

结构化决策摘要、候选、引用、工具调用和状态变化适合作为运行证据。完整隐式推理既不稳定,也会扩大敏感信息风险。

因果与身份链

principal → agent → workload → session → run → intent
          → approval → model/tool/sub-agent span → resource → outcome

Trace Context 负责跨进程传播,业务对象仍需要稳定 ID。一次重试可以产生新 span,不能因此生成新的业务意图或重复副作用。

生命周期中的证据

阶段重点
登记与设计负责人、能力版本、事件合同、敏感字段与保留周期
评测与灰度样本、轨迹、版本差异、拒绝与回滚原因
运行调用链、状态变化、外部结果、延迟、成本与策略裁决
复验与演进故障簇、修改预测、回归结果、升降级与退役证据

常见失效

  • 记录大量文本,却没有对象 ID、版本和状态差异;
  • 把 HTTP 200 或 exit code 0 当成业务成功;
  • 跨 Agent、队列和回调断链;
  • 采样集中在简单任务;
  • 敏感 prompt 和凭证无限留存;
  • 把 X2 的评分判断混入 X1 的观测事实。

验证

检查 trace 连续性、身份与版本完整度、有副作用动作的外部结果确认、孤儿写操作、证据时延、采样偏差和敏感证据访问。覆盖跨进程、重试、恢复、模型 fallback、schema 升级和 collector 故障。

公开实现

DeerFlow Guardrail展示身份、授权裁决、RunJournal 与工具执行之间的公开代码路径。业务状态差异和外部结果由接入方补充。

引用建议:ADPS,《X1 · Observability · 可观测性》,ADPS 横切工程面规范 v0.5,2026-08-20。

可观测性专题 · 治理研讨会 · CC BY 4.0

使用边界:本页定义工程范围与接口,不构成产品认证。具名实践以案例页与公开代码为准。