Agent 的 Fallback、Abstain 与 Escalate

区分 Agent 在无法安全 AUTO 时的三种受控退路:切换到更保守的可执行路径、拒绝作出当前判断,以及把决策权转移给更高权限主体。

#type / synthesis #status / growing #tech / ai #tech / architecture #resource / agent

[!info] related notes

Agent 的 Fallback、Abstain 与 Escalate

范围

这篇笔记只比较当 Agent 不能继续安全 AUTO 时的决策退路。它不讨论 LLM Provider 5xx 后切备用 endpoint 的基础设施 fallback;后者见 Fallback Strategy

核心关系

AUTO 不再被允许

能否在当前权限内使用更保守、已批准的方法继续?
        ├─ 能 → FALLBACK
        └─ 不能

        是否应该明确不作当前判断?
             ├─ 是 → ABSTAIN
             └─ 需要更高 authority → ESCALATE

FALLBACK

Fallback 表示仍由当前系统负责完成目标,但切换到一个更保守、能力更低或约束更强的已批准路径

例如:

高级自动判断不可用
→ 返回受限的安全建议 + 明确不确定性

关键点:fallback 仍然必须在另一个已批准 policy/safety envelope 内。它不是“主路径不行就随便给个答案”。

ABSTAIN

Abstain 表示:

当前证据不足或风险条件不允许系统可靠完成这个判断,因此明确不作该判断。

它不是系统崩溃,而是一种合法、可评测的结果。

典型触发:

  • critical gap 无法关闭;
  • 证据互相冲突且无法消解;
  • 当前 case 超出所有可用自动化 envelope;
  • 输出若继续生成会制造不可接受的虚假确定性。

ESCALATE

Escalate 表示把决策权转移到拥有更高权限、更多信息或更强责任能力的主体,例如人工审核、更高等级服务、专业人员或专门安全流程。

Escalation 的本质不是“再试一个模型”,而是 authority boundary 改变。

三者最重要的区别

模式当前系统是否继续给出决策Authority 是否变化典型目的
Fallback是,但更保守通常不变在批准范围内继续服务
Abstain不一定避免无证据判断
Escalate当前系统不再独立决定交给更高权限主体

与 Evidence Acquisition 的关系

不能 AUTO 时,第一反应通常不必立刻降级。如果 decision-relevant gap 仍有合理获取路径,可以先:

OPEN gap
→ evidence acquisition
→ re-evaluate

只有 gap 仍无法关闭、预算耗尽或继续取证不合适时,再按版本化 policy选择 fallback / abstain / escalate。

常见误解

  • Fallback = Escalate:fallback 多数仍在同一 authority 内;escalate 是交权。
  • Abstain = error:abstention 可以是设计正确的安全输出。
  • 预算耗尽就 fallback:具体退路必须由 policy 决定,预算耗尽本身只是一种 stopping reason。
创建于 2026/8/19 更新于 2026/8/19