Agent 的 Fallback、Abstain 与 Escalate
区分 Agent 在无法安全 AUTO 时的三种受控退路:切换到更保守的可执行路径、拒绝作出当前判断,以及把决策权转移给更高权限主体。
#type / synthesis
#status / growing
#tech / ai
#tech / architecture
#resource / agent
[!info] related notes
- 所属 MOC: agent-evals-moc、agent-moc
- 相关概念: fallback-strategy、human-oversight-in-agents、stopping-conditions-in-agents
- 易混淆概念:
- 相关资源:
Agent 的 Fallback、Abstain 与 Escalate
范围
这篇笔记只比较当 Agent 不能继续安全 AUTO 时的决策退路。它不讨论 LLM Provider 5xx 后切备用 endpoint 的基础设施 fallback;后者见 Fallback Strategy。
核心关系
AUTO 不再被允许
↓
能否在当前权限内使用更保守、已批准的方法继续?
├─ 能 → FALLBACK
└─ 不能
↓
是否应该明确不作当前判断?
├─ 是 → ABSTAIN
└─ 需要更高 authority → ESCALATE
FALLBACK
Fallback 表示仍由当前系统负责完成目标,但切换到一个更保守、能力更低或约束更强的已批准路径。
例如:
高级自动判断不可用
→ 返回受限的安全建议 + 明确不确定性
关键点:fallback 仍然必须在另一个已批准 policy/safety envelope 内。它不是“主路径不行就随便给个答案”。
ABSTAIN
Abstain 表示:
当前证据不足或风险条件不允许系统可靠完成这个判断,因此明确不作该判断。
它不是系统崩溃,而是一种合法、可评测的结果。
典型触发:
- critical gap 无法关闭;
- 证据互相冲突且无法消解;
- 当前 case 超出所有可用自动化 envelope;
- 输出若继续生成会制造不可接受的虚假确定性。
ESCALATE
Escalate 表示把决策权转移到拥有更高权限、更多信息或更强责任能力的主体,例如人工审核、更高等级服务、专业人员或专门安全流程。
Escalation 的本质不是“再试一个模型”,而是 authority boundary 改变。
三者最重要的区别
| 模式 | 当前系统是否继续给出决策 | Authority 是否变化 | 典型目的 |
|---|---|---|---|
| Fallback | 是,但更保守 | 通常不变 | 在批准范围内继续服务 |
| Abstain | 否 | 不一定 | 避免无证据判断 |
| Escalate | 当前系统不再独立决定 | 是 | 交给更高权限主体 |
与 Evidence Acquisition 的关系
不能 AUTO 时,第一反应通常不必立刻降级。如果 decision-relevant gap 仍有合理获取路径,可以先:
OPEN gap
→ evidence acquisition
→ re-evaluate
只有 gap 仍无法关闭、预算耗尽或继续取证不合适时,再按版本化 policy选择 fallback / abstain / escalate。
常见误解
- Fallback = Escalate:fallback 多数仍在同一 authority 内;escalate 是交权。
- Abstain = error:abstention 可以是设计正确的安全输出。
- 预算耗尽就 fallback:具体退路必须由 policy 决定,预算耗尽本身只是一种 stopping reason。