Agent 应用开发会员账号
知识目录选择核心方向与细分内容
知识单元 49高级场景设计约 18 分钟

理解 → 实现 → 排错 → 取舍

备用模型的能力与状态契约

考察多模型适配、能力矩阵、失败分类和降级。

模型路由Fallback限流

知识内容核对 2026-10-03 · 原题来源核对 2026-10-02

这个知识点,你想学到哪一步?

按当前基础选择起点,也可以依次深入。遇到不熟悉的概念,先回到核心原理;完成后用知识练习检查理解。

先理解

刚接触这个知识点

补齐先备概念,读原理与反例,再用自己的话解释为什么。

从核心原理开始 →

再实现

准备把原理写进代码

理解实现步骤与边界,完成小任务,对照验收要求检查结果。

阅读实现与取舍 →

会排错

需要处理故障与条件变化

沿连续追问定位失效前提,再比较迁移案例,说明方案应如何调整。

沿问题继续深入 →

能取舍

需要设计或评审方案

结合工程推演与资深自评标准,解释方案的适用条件、代价和替代选择。

分析工程场景 →
知识单元目录

LEARN · PRACTICE · REFLECT

知识学习与个人记录

我的笔记与复习 ↗

先沿着原理、问答和迁移案例阅读。需要检查理解时,再切换巩固练习或展开个人记录。

作答与个人记录

每次修改后的提交会保留为独立历史。掌握程度由你对照标准自评。

核心知识 · 备用模型的能力与状态契约

先理解核心原理

先备概念:错误分类、工具调用关联、有界重试

切换模型改变决策器,不能重置已执行事实、授权与预算。备用模型只有满足任务所需能力和消息语义,才是可执行的降级路径。

可重试错误与拒绝不同

临时限流或服务不可用可能适合等待或换供应商;参数错误需要修正,权限拒绝需要停止,安全拒答不能因想得到答案就自动换模型。分类由运行时和业务政策决定,模型自由解释错误可能扩大权限。

适配的是语义,不只是 JSON

不同模型的工具消息、关联 ID、结构化输出和上下文长度可能不同。内部记录业务动作、参数、执行状态与证据,适配器再转换为目标模型能理解的历史;不能把已成功发信改成一个待执行 tool call。未知状态先核对。

降级不等于总能完成

备用模型不支持所需工具或证据长度时,可降低任务范围、仅返回已证实部分,或暂停人工处理。用总 deadline、调用预算与有限退避约束整条路由,避免主备相互切换放大压力。下面的路由与映射属于教学设计,未验证任何模型互换兼容性。

用一个问题检查理解

主模型限流后切备用模型,怎样保证工具调用和行为不失控?

先区分临时限流、参数错误、权限拒绝和业务失败,只有适合重试的情况才触发备用路由。为每个模型验证工具调用、结构化输出和上下文能力,使用统一内部消息与动作契约。切换前保存已执行事实,不能重放有副作用的工具。备用模型仍受同一权限和预算约束;无法满足能力时应明确降级或暂停。

实现与取舍

降级策略由任务需要决定

简单摘要可以切到便宜模型,复杂多工具任务需要验证备用模型是否支持相同输出契约。不能仅凭两个接口都接收 messages 就认为行为兼容。维护能力矩阵与实际契约测试,检查工具参数、并行调用、拒答与上下文长度等边界;某些请求无法无损转换就应拒绝切换。

区分重试和重新执行

模型请求失败可能安全重试,但运行中已经执行过的工具结果必须保留。将已确认事件转换成备用模型理解的内部状态,避免再次要求执行同一写动作。工具调用 ID 的格式可以重新映射,业务操作 ID 仍保持稳定。中途切换后也要重新检查模型提出的下一步是否合法。

限流和预算

遵守供应商建议的等待时间并采用受控退避,限制跨模型重试次数。全局预算计算主模型失败请求、备用请求和工具重试成本,不能各路分别认为预算充足。熔断异常路由,恢复后小流量探测,不要在供应商短暂故障时制造更大请求风暴。

可解释降级

记录切换原因、能力变化和实际质量。如果备用只能生成草稿,就不能照常自动发布;若上下文需要压缩,应验证关键约束。对同一任务集测故障切换前后的完成率、违规率和费用,同时保留完全不可用时的明确错误状态。降级目标是受控可用,不是任何情况下都返回一段文本。

工程推演

场景
面试假设:主模型限流,备用模型不支持某个结构化输出约束。
设计决策
路由层检查能力,使用经过验证的适配或退回草稿模式。
验证目标
切换不重复写动作,能力不足不会伪装完整成功。
适用边界
备用质量需要在具体任务上评测,不能按品牌推断。

连续追问与解答

沿着问题的前提和约束继续向下读。先理解参考解答,再尝试收起答案,用自己的话解释因果和取舍。

举一反三:条件变了,怎样推导?

先找出改变的条件,再判断原方案中哪些前提仍成立。下面的案例是教学推演,便于将原理迁移到新问题。

备用不支持大上下文

改变的条件:证据规模超出备用能力。

延伸问题:简单截断历史是否合理?

推导与参考解答

只按明确的证据选择规则收缩任务,保留关键约束、已执行账本与必要来源;如果无法维持正确判断,暂停或转人工。截掉旧工具效果可能诱导重放,截掉授权条件可能扩大动作,不能把字数压缩当语义兼容。

保持不变的原理:降级后仍需满足任务最小能力和事实契约。

主模型读操作后业务写入超时

改变的条件:路由故障与未知副作用叠加。

延伸问题:切备用重新开始能解决吗?

推导与参考解答

不能。先在执行账本标未知并查询目标结果;备用只接手可安全继续的步骤。保持原业务键与预算,结果确认后才构建历史。模型切换不改变目标系统可能已提交的事实。

保持不变的原理:决策器变化不能抹掉外部执行状态。

易错点

  • 错误一律切模型
  • 切换后重跑所有工具
  • 备用模型绕过原权限和预算

参考资料

依据公开技术资料设计;参考资料支持技术机制,场景与评分标准为本站设计,不代表某公司面试原题。 新增问答与迁移案例用于原理讲解,来源核查与案例运行验证分别记录。

检查自己理解到哪一步

读完后可以对照这些标准解释原理、边界和取舍。掌握程度由你自评;需要进一步验证时,再完成下方小任务。

基础达标
能区分临时限流、参数错误和权限拒绝,不一律切模型。
中高级信号
能维护能力契约与已执行事件,避免重复副作用。
资深信号
有跨路由预算、熔断、质量门槛和明确降级状态。

动手验证 按需完成 · 建议 15 分钟

为模型 429、无效参数、工具已提交三种失败设计路由表。

展开验收要求与检查点
  • 永久错误不盲重试
  • 切换不重放写动作
  • 能力不满足时有明确终态

重点检查

  • 模型接口兼容不等于能力兼容
  • 保持已执行事实和操作 ID
  • 预算覆盖所有重试路径