DeepSeek Harness Hub
← 返回列表

chunsi-w/dsh-trajectory-governor

DeepSeek Harnessspec-screened在 GitHub 查看 ↗
⚠ 装前注意

面向 DeepSeek Harness 的闭环 Agent 轨迹控制平面。它不是继续增强一句…

基本兼容但装前注意:未发布到 npm registry,仅可从源码安装 · 最近上游提交 2026/8/18 · 已提供中文文档

DeepSeek Harness 的闭环轨迹策略平面

综合分
34.6
GitHub 分
34.6
用户评分
★ Stars
12
周下载量
安装插件(需先安装 dsh CLI 引擎:npm install -g @deepseek-ai/dsh)
dsh plugin --profile web add chunsi-w/dsh-trajectory-governor
未发布到 npm registry,仅可从源码安装,改用 GitHub 源安装
数据截至 2026/9/18(元数据每日更新 · 实装验证按队列轮转,单条结论的验证时间见上方)
安装兼容性检查⚠ 装前注意

以下结论由程序自动检查 npm 包、engines 声明与入口文件得出,未做人工实机验证——能装不等于用着没问题。

npm 包@chunsi-m/dsh-trajectory-governor(未发布到 npm,仅可源码安装)
Node 引擎要求 ^22.19.0 || >=24.0.0 · 基线 Node 22.19 满足
dsh CLI 依赖未声明 dsh 版本约束
入口文件main/exports/bin 已声明

未发布到 npm registry,仅可从源码安装

验证方式:npm registry 存在性 + package.json 静态校验 · 最后验证 2026/9/18 12:13:08

依赖的 DSH / Cordis 模块
@deepseek-ai/schemastery@deepseek-ai/cordis@deepseek-ai/dsh-agent@deepseek-ai/dsh-agent-loop@deepseek-ai/dsh-code-runtime-worker-thread@deepseek-ai/dsh-llm@deepseek-ai/dsh-plan-mode@deepseek-ai/dsh-session@deepseek-ai/dsh-system-prompt@deepseek-ai/dsh-tools
用户评分
还没有人投票,来当第一个
订阅周报,不错过优质插件更新
每周一封 · 高评分插件 + 新用户活动

README

dsh-trajectory-governor

面向 DeepSeek Harness 的闭环 Agent 轨迹控制平面。它不是继续增强一句 persona,也不是把会话永久分成 spec/react,而是围绕真实事件流维护:

- Task Episode 与连续性关系;
- 当前工作阶段;
- 结构化信息增益;
- 修改后的验证债务;
- workspace revision 与完整 benchmark 证据;
- 同规格、带容差的性能回归判断;
- 重复调用与无新信息轨迹;
- scoped 工具能力面;
- 显式 finish 与自然结束的完成门;
- 可选的自适应 reasoning effort;
- 本地、非模型可见的决策账本。

本项目是对 dsh-mode-boost 的 clean-sheet 重构,不依赖 preset fork,也不依赖 super-injector。

已实现的闭环

真人消息被 inbox claim
-> 在第一次 prompt assembly 前建立 Task Contract
-> 判断 new / continuation / extension / correction / review / conversation
-> 必要时通过 agent.ctx.tools.restrict() 暂时隐藏 write/edit
-> agent/pre-step 在同一个请求内追加可重建的近场 policy message
-> Native tool 或 Code Mode SDK 子调用产生 durable 事件
-> 计算 observation novelty / mutation / verification
-> 修改产生 Verification Debt
-> readback + test/build/check 清偿当前 revision 的债务
-> 可选 benchmark gate 只接受当前 revision 的完整、可解析结果
-> 同 query count / concurrency / warmup 才比较 QPS,容差内不误判噪声
-> finish guard 与 turn-stopping 阻止无证据结束
-> 有限续步耗尽后要求模型明确报告 blocker
安装

要求:

- Node.js ^22.19.0 || >=24.0.0;
- DeepSeek Harness 0.1.0-rc.7(开发与集成测试基线);peer range 兼容 0.1.0-rc.5 至 = fullBenchmarkMinQueries 且 recall >= fullBenchmarkMinRecall 才能通过当前 revision;无法解析的结果明确成为 blocker,绝不当作 pass。
- QPS 只和相同 total_queries、concurrency、warmup 的 best record 比较;1K 与 10K 不会混比。
- 同规格下降未超过 benchmarkScoreTolerancePercent 时保留为可接受噪声;超过容差时,当前 revision 不能结束,模型必须恢复已知好版本或提出并验证新假设。
- 每次已识别 mutation 或高风险 shell 写入都会使先前 benchmark 失效;新的 current-revision full pass 才会重新打开 finish。
- agent.ctx.tools.guard() 拦截已配置的显式 finish;自然结束由 agent/turn-stopping 以同一门槛处理。

Governor 只保留 benchmark best record 与状态,不直接写用户工作区。因此它不会伪造“自动 rollback”:外部 evaluator/harness 若需要真正自动恢复,必须自己提供可验证的 checkpoint/restore API。

Native 与 Code Mode

Governor 同时观察:

- Native:tool/call / tool/result;
- Code Mode:tool/code-dispatch-start / tool/code-dispatch。

因此 run_code 内部的 read/write/edit 也会更新信息增益、释放 restriction、创建并清偿验证债务。

状态工具

trajectory_policy_status

返回当前调用 Agent 自己的:

- episode / human round;
- relation / kind / phase / risk;
- artifacts;
- observed / mutated artifacts;
- 当前 restriction;
- no-information、recovery blocker 与 repeated-call 计数;
- revision-aware open verification debt;
- benchmark 当前 revision pass、最新结果、同规格 best record、平台期和 blocker;
- ledger 轮转/失败状态;
- 最终 assembly hash。

实现严格使用 exec.agent,不会读取“最后组装请求的另一个会话”。

决策账本与隐私

默认路径:

$DSH_HOME/trajectory-governor/decisions.jsonl

账本保存:

- session/message id;
- 原消息 SHA-256,不保存原文;
- relation、phase、risk、complexity;
- restriction;
- tool effect、artifact、错误、novelty;
- open verification debt;
- request assembly hash;
- turn stop reason。

账本失败不会改变官方 Agent 执行流,但不再静默吞掉:首次写入失败会输出一条 console.error,trajectory_policy_status 的 ledger.failed/error 也会暴露原因,随后停止重试该账本。活动文件在 maxLedgerBytes 前轮转为带时间戳的 JSONL,历史记录不会被删除。

构建与测试

npm install
npm run check

当前测试覆盖:

- Task Episode 关系;
- 寒暄后真实任务;
- correction / extension continuity;
- artifact 提取;
- tool semantics;
- revision-aware verification debt 与 shell mutation risk;
- benchmark 结构化解析、1K/10K 隔离、容差比较;
- 显式 finish guard、自然结束 blocker-report、修改后 benchmark 失效;
- no-information completion blocker;
- JSONL rotation 与账本失败状态;
- Minimal 防失能;
- Code Mode restriction;
- 首次请求前捕获输入;
- 同请求近场 policy;
- runtime context 保留;
- 观察后释放写工具;
- 自动验证续步上限;
- adaptive reasoning 选择与恢复;
- 多会话状态隔离;
- shadow mode 请求不干预。

当前限制

- relation engine 是可解释规则基线,不是 learned classifier;
- artifact graph 目前以路径和工具参数为主;
- shell 命令语义只能保守识别;
- benchmark 只能接受工具输出中明确命名的指标;不能从自由文本性能宣称推断 pass;
- 没有官方 workspace checkpoint API,所以不执行自动 rollback;外部 evaluator 必须提供 restore 机制;
- 没有自动 subagent evaluator;
- 没有 contextual bandit;
- 没有 workspace counterfactual fork runner;
- 外部插件尚无官方 custom durable SessionEvent 注册面,所以研究决策存在 sidecar,而不是伪造未知 session event;
- Governor 不替代测试、sandbox、approval 或人工评审。

代码结构

src/core.ts       Task Episode、PolicyPlan、工具语义、Verification Debt 纯逻辑
src/index.ts      Harness runtime hooks 与闭环控制
src/ledger.ts     本地 append-only sidecar
cordis.patch.yml  官方 DSH bundle 层
tests/            纯逻辑与真实 AgentLoop 集成测试

上游仓库有新提交时邮件通知你(每天最多一封,无更新不打扰),随时一键退订。

💬 加入 DPharness 群聊

插件用法、部署报错、新插件第一时间同步——群里问,比一个人翻文档快。

点击加入 QQ 群
DPharness 群聊二维码,手机 QQ 扫码进群
扫码进群