← 返回列表
⚠ 装前注意
面向 DeepSeek Harness 的闭环 Agent 轨迹控制平面。它不是继续增强一句…
基本兼容但装前注意:未发布到 npm registry,仅可从源码安装 · 最近上游提交 2026/8/18 · 已提供中文文档
DeepSeek Harness 的闭环轨迹策略平面
综合分
34.6
GitHub 分
34.6
用户评分
—
★ Stars
12
周下载量
—
安装插件(需先安装 dsh CLI 引擎:npm install -g @deepseek-ai/dsh)
dsh plugin --profile web add chunsi-w/dsh-trajectory-governor未发布到 npm registry,仅可从源码安装,改用 GitHub 源安装
数据截至 2026/9/18(元数据每日更新 · 实装验证按队列轮转,单条结论的验证时间见上方)
安装兼容性检查⚠ 装前注意
以下结论由程序自动检查 npm 包、engines 声明与入口文件得出,未做人工实机验证——能装不等于用着没问题。
✗npm 包@chunsi-m/dsh-trajectory-governor(未发布到 npm,仅可源码安装)
✓Node 引擎要求 ^22.19.0 || >=24.0.0 · 基线 Node 22.19 满足
✓dsh CLI 依赖未声明 dsh 版本约束
✓入口文件main/exports/bin 已声明
未发布到 npm registry,仅可从源码安装
验证方式:npm registry 存在性 + package.json 静态校验 · 最后验证 2026/9/18 12:13:08
依赖的 DSH / Cordis 模块
@deepseek-ai/schemastery@deepseek-ai/cordis@deepseek-ai/dsh-agent@deepseek-ai/dsh-agent-loop@deepseek-ai/dsh-code-runtime-worker-thread@deepseek-ai/dsh-llm@deepseek-ai/dsh-plan-mode@deepseek-ai/dsh-session@deepseek-ai/dsh-system-prompt@deepseek-ai/dsh-tools用户评分
还没有人投票,来当第一个
订阅周报,不错过优质插件更新
每周一封 · 高评分插件 + 新用户活动
README
dsh-trajectory-governor 面向 DeepSeek Harness 的闭环 Agent 轨迹控制平面。它不是继续增强一句 persona,也不是把会话永久分成 spec/react,而是围绕真实事件流维护: - Task Episode 与连续性关系; - 当前工作阶段; - 结构化信息增益; - 修改后的验证债务; - workspace revision 与完整 benchmark 证据; - 同规格、带容差的性能回归判断; - 重复调用与无新信息轨迹; - scoped 工具能力面; - 显式 finish 与自然结束的完成门; - 可选的自适应 reasoning effort; - 本地、非模型可见的决策账本。 本项目是对 dsh-mode-boost 的 clean-sheet 重构,不依赖 preset fork,也不依赖 super-injector。 已实现的闭环 真人消息被 inbox claim -> 在第一次 prompt assembly 前建立 Task Contract -> 判断 new / continuation / extension / correction / review / conversation -> 必要时通过 agent.ctx.tools.restrict() 暂时隐藏 write/edit -> agent/pre-step 在同一个请求内追加可重建的近场 policy message -> Native tool 或 Code Mode SDK 子调用产生 durable 事件 -> 计算 observation novelty / mutation / verification -> 修改产生 Verification Debt -> readback + test/build/check 清偿当前 revision 的债务 -> 可选 benchmark gate 只接受当前 revision 的完整、可解析结果 -> 同 query count / concurrency / warmup 才比较 QPS,容差内不误判噪声 -> finish guard 与 turn-stopping 阻止无证据结束 -> 有限续步耗尽后要求模型明确报告 blocker 安装 要求: - Node.js ^22.19.0 || >=24.0.0; - DeepSeek Harness 0.1.0-rc.7(开发与集成测试基线);peer range 兼容 0.1.0-rc.5 至 = fullBenchmarkMinQueries 且 recall >= fullBenchmarkMinRecall 才能通过当前 revision;无法解析的结果明确成为 blocker,绝不当作 pass。 - QPS 只和相同 total_queries、concurrency、warmup 的 best record 比较;1K 与 10K 不会混比。 - 同规格下降未超过 benchmarkScoreTolerancePercent 时保留为可接受噪声;超过容差时,当前 revision 不能结束,模型必须恢复已知好版本或提出并验证新假设。 - 每次已识别 mutation 或高风险 shell 写入都会使先前 benchmark 失效;新的 current-revision full pass 才会重新打开 finish。 - agent.ctx.tools.guard() 拦截已配置的显式 finish;自然结束由 agent/turn-stopping 以同一门槛处理。 Governor 只保留 benchmark best record 与状态,不直接写用户工作区。因此它不会伪造“自动 rollback”:外部 evaluator/harness 若需要真正自动恢复,必须自己提供可验证的 checkpoint/restore API。 Native 与 Code Mode Governor 同时观察: - Native:tool/call / tool/result; - Code Mode:tool/code-dispatch-start / tool/code-dispatch。 因此 run_code 内部的 read/write/edit 也会更新信息增益、释放 restriction、创建并清偿验证债务。 状态工具 trajectory_policy_status 返回当前调用 Agent 自己的: - episode / human round; - relation / kind / phase / risk; - artifacts; - observed / mutated artifacts; - 当前 restriction; - no-information、recovery blocker 与 repeated-call 计数; - revision-aware open verification debt; - benchmark 当前 revision pass、最新结果、同规格 best record、平台期和 blocker; - ledger 轮转/失败状态; - 最终 assembly hash。 实现严格使用 exec.agent,不会读取“最后组装请求的另一个会话”。 决策账本与隐私 默认路径: $DSH_HOME/trajectory-governor/decisions.jsonl 账本保存: - session/message id; - 原消息 SHA-256,不保存原文; - relation、phase、risk、complexity; - restriction; - tool effect、artifact、错误、novelty; - open verification debt; - request assembly hash; - turn stop reason。 账本失败不会改变官方 Agent 执行流,但不再静默吞掉:首次写入失败会输出一条 console.error,trajectory_policy_status 的 ledger.failed/error 也会暴露原因,随后停止重试该账本。活动文件在 maxLedgerBytes 前轮转为带时间戳的 JSONL,历史记录不会被删除。 构建与测试 npm install npm run check 当前测试覆盖: - Task Episode 关系; - 寒暄后真实任务; - correction / extension continuity; - artifact 提取; - tool semantics; - revision-aware verification debt 与 shell mutation risk; - benchmark 结构化解析、1K/10K 隔离、容差比较; - 显式 finish guard、自然结束 blocker-report、修改后 benchmark 失效; - no-information completion blocker; - JSONL rotation 与账本失败状态; - Minimal 防失能; - Code Mode restriction; - 首次请求前捕获输入; - 同请求近场 policy; - runtime context 保留; - 观察后释放写工具; - 自动验证续步上限; - adaptive reasoning 选择与恢复; - 多会话状态隔离; - shadow mode 请求不干预。 当前限制 - relation engine 是可解释规则基线,不是 learned classifier; - artifact graph 目前以路径和工具参数为主; - shell 命令语义只能保守识别; - benchmark 只能接受工具输出中明确命名的指标;不能从自由文本性能宣称推断 pass; - 没有官方 workspace checkpoint API,所以不执行自动 rollback;外部 evaluator 必须提供 restore 机制; - 没有自动 subagent evaluator; - 没有 contextual bandit; - 没有 workspace counterfactual fork runner; - 外部插件尚无官方 custom durable SessionEvent 注册面,所以研究决策存在 sidecar,而不是伪造未知 session event; - Governor 不替代测试、sandbox、approval 或人工评审。 代码结构 src/core.ts Task Episode、PolicyPlan、工具语义、Verification Debt 纯逻辑 src/index.ts Harness runtime hooks 与闭环控制 src/ledger.ts 本地 append-only sidecar cordis.patch.yml 官方 DSH bundle 层 tests/ 纯逻辑与真实 AgentLoop 集成测试
扫码进群