🎁 福利专区全网大模型免费应用 + 新用户福利 + 注册活动入口,低成本玩转 AI
广告☁️ 云服务器特惠阿里云首购 8 折 · 腾讯云合作特惠
DeepSeek Harness Hub
← 返回列表

force-push/dsh-llm-fallback

DeepSeek Harnessspec-screened扫描:低风险在 GitHub 查看 ↗
未验证

@deepseek-ai/dsh-llm-fallback

尚未跑自动兼容性验证,可查看页面内的依赖与入口分析。 · 最近上游提交 2026/8/30 · 已提供中文文档

DeepSeek Harness (DSH) 的自愈式跨提供商模型回退插件——重试耗尽后,将会话重新绑定到下一个健康的模型。

综合分
27.9
GitHub 分
27.9
用户评分
—
★ Stars
0
周下载量
—
安装插件(需先安装 dsh CLI 引擎:npm install -g @deepseek-ai/dsh)
dsh plugin --profile web add force-push/dsh-llm-fallback
该插件未发布到 npm,走 GitHub 源安装(pnpm 若拦截 prepare 脚本,按其提示在 pnpm-workspace.yaml 的 allowBuilds 中放行后重跑)
信任档位:仅索引本站尚未对其实装验证,仅收录元数据
是什么
dsh 原生插件 · chat
装得上吗
本站尚未做安装检查
安全吗
本站尚未对该插件做风险分级(暂未覆盖,不等同于无风险)
还在维护吗
活跃:最近一次提交在 26 天前

档位由下列信号合成:本站实装验证(真实安装,当前最高到 L4)· 验证所用 dsh 版本 · 静态安装检查 · 风险分级 · 仓库维护状态。下方各区块是它的证据明细。 验证判据与等级说明 →

数据截至 2026/9/20(元数据每日更新 · 实装验证按队列轮转,单条结论的验证时间见上方)
依赖的 DSH / Cordis 模块
@deepseek-ai/cordis@deepseek-ai/dsh-agent@deepseek-ai/dsh-agent-loop@deepseek-ai/dsh-invariants@deepseek-ai/dsh-llm@deepseek-ai/dsh-llm-retry@deepseek-ai/dsh-session@deepseek-ai/dsh-settings@deepseek-ai/dsh-settings-file@deepseek-ai/dsh-system-prompt@deepseek-ai/dsh-tools@deepseek-ai/schemastery
用户评分
还没有人投票,来当第一个
订阅周报,不错过优质插件更新
每周一封 · 高评分插件 + 新用户活动

README

由 DeepSeek 最新模型翻译生成
@deepseek-ai/dsh-llm-fallback

自愈式跨提供方模型回退。当一次模型请求以可治愈的失败码告终、且原地重试已经耗尽时,插件会选中链上的下一个回退目标,并通过运行时模型选择器所用的同一条 agent/request waterfall 把重试重新绑定到该目标——会话将在健康的模型上继续,而不是直接失败。

工作方式

插件监听两个 agent 作用域的 waterfall:

- agent/request-error——恢复决策点。插件挂载在 @deepseek-ai/dsh-llm-retry 之后,只会看到策略委派下来的失败:已耗尽的重试预算、落在 healOn 内的不可重试失败码,或超出上限的提供方延迟。它会选出第一个存活且尚未尝试过的回退目标,追加一条持久化的非表面 llm/fallback 事件,并返回 { kind: 'retry' }。
- agent/request——重绑定点。治愈生效期间,请求配置会被改写为回退路由;配置的 reasoningEffort 随请求发送,缺省时清除任何继承的 effort(与运行时模型选择器语义一致)。

always 模式的主路由通过委派获得尊重:它绝不会在本插件上 settle,因此链应当监视 normal 模式策略的路由。显式的运行时模型选择优先于治愈——第一次选择即令治愈自解除。

每个决策都是持久的:llm/fallback 事件记录失败的提供方、失败事实与选中的回退,远端渲染器无需加载本运行时即可展示治愈过程。

配置

组合条目提供 base;用户设置文档中的 llm-fallback 分节会在下一次失败时整体替换它(无需重启):

llm-fallback:
chains:
- primary: { provider: z-ai-glm-53-flash }
fallbacks:
- { provider: openrouter, model: nvidia/nemotron-3-ultra-550b-a55b:free }
- { provider: openrouter, model: minimax/minimax-m3:free }
healOn: [SERVER, TIMEOUT, TRANSPORT, RATE_LIMIT, EMPTY_RESPONSE, INVALID_REQUEST]
sticky: true

| 字段 | 含义 |
| --- | --- |
| chains | 有序的治愈链;空列表使插件保持休眠。 |
| chains[].primary | 被监视的路由。model 缺省时监视该提供方路由上的所有模型。 |
| chains[].fallbacks | 有序目标;每项需要 provider 与 model,可选 reasoningEffort(off/low/high/max)。 |
| healOn | 触发治愈的失败码;其余失败码委派给下游。 |
| sticky | true 在 agent 余下生命周期内保持治愈;false 在治愈所在回合关闭时重新绑定 agent 自身的路由。 |

格式错误的分节会在写入处被拒绝——设置写入失败时会指明出错的链与字段。

安装

在 DeepSeek Harness 包发布到 npm 之前,将本仓库以 vendored 方式放入 DSH checkout:

git clone https://github.com/force-push/dsh-llm-fallback.git packages/llm/llm-fallback
pnpm install && pnpm run build:lib:host

harness 包发布后,npm install dsh-llm-fallback 即可替代 vendored 方式。

挂载

在宿主组合(或 profile patch)中把插件放在 llm-retry 之后:

- id: llm-fallback
name: '@deepseek-ai/dsh-llm-fallback'

回退路由必须是已注册的适配器路由——@deepseek-ai/dsh-llm-pi-ai 的已配置提供方路由或任何其他适配器家族。治愈时刻会跳过指向未注册路由的条目。

语义与限制

- 原地重试优先。 只有被监视路由自身的重试策略在该步骤耗尽后,才会查询链。
- 部分失败立即治愈。 原地重试无法修复的失败码(INVALID_REQUEST 一类的拒绝)在第一次出现时即治愈。
- 不检查上下文容量。 小于会话的回退模型将在上下文上失败;请有意地与 compaction 组合。
- Agent 回合是治愈边界——直接消费 ctx.llm.stream() 的调用方只有一次尝试,与 dsh-llm-retry 一致。
- 治愈会掩盖配置错误。 错误的 effort 表或端点会表现为被治愈掉的失败;持久化事件就是审计线索。
- 治愈需要已有路由。 链监视的是模型请求;未配置 provider/model 的 agent 会更早失败——在系统提示词组装或分发阶段——那时还没有任何可供治愈的请求。此类 agent 应从部署的 agent-default-model 取默认路由,或在挂载组合中显式固定路由。

上游仓库有新提交时邮件通知你(每天最多一封,无更新不打扰),随时一键退订。

💬 加入社群

插件用法、部署报错、新插件第一时间同步——群里问,比一个人翻文档快。

DPharness QQ 群二维码,QQ 扫码进群
QQ 扫码进群
DPharness 飞书群二维码,飞书扫码进群
飞书扫码进群