DeepSeek Harness Hub
← 返回列表

aoripus/dsh-optimize

DeepSeek Harnessspec-screened在 GitHub 查看 ↗
未验证

面向 DeepSeek Harness 的长会话资源治理插件。

尚未跑自动兼容性验证,可查看页面内的依赖与入口分析。 · 最近上游提交 2026/9/14 · 已提供中文文档

DeepSeek Harness 的长会话资源控制:测量每次请求携带的上下文,在可配置阈值处发出警告,可在超出预算时运行 harness 压缩引擎,并将屏幕外的聊天行收纳在开关之后。

综合分
29.7
GitHub 分
29.7
用户评分
★ Stars
0
周下载量
安装插件(需先安装 dsh CLI 引擎:npm install -g @deepseek-ai/dsh)
dsh plugin --profile web add aoripus/dsh-optimize
该插件未发布到 npm,走 GitHub 源安装(pnpm 若拦截 prepare 脚本,按其提示在 pnpm-workspace.yaml 的 allowBuilds 中放行后重跑)
数据截至 2026/9/17(元数据每日更新 · 实装验证按队列轮转,单条结论的验证时间见上方)
用户评分
还没有人投票,来当第一个
订阅周报,不错过优质插件更新
每周一封 · 高评分插件 + 新用户活动

README

dsh-optimize

面向 DeepSeek Harness 的长会话资源治理插件。

一个不断变长的会话,在压缩真正发生之前就已经很贵了:每一步都要重发保留的历史,
会话日志无限增长,浏览器也要为越来越多的历史付出绘制成本。dsh-optimize
把这种增长变成看得见的数字,并在你设定的预算上采取行动。

宿主侧:测量与阈值

- 在每次 agent/pre-step 上用 tokenMeter.measure() 量出这次请求真正携带的上下文,
同时读取 harness 自己的 contextPressure 投影(O(1))作为对照。
- 按会话累计:请求数、事件数、当前/峰值 token、模型窗口、压缩次数、测量来源
(tokenMeter / contextPressure / 估算),写入
$DSH_HOME/storages/dsh-optimize/state.json。
- 首次越过 warnTokens、以及越过 criticalTokens 时各告警一次。
- 可选(默认关闭):越过 compactAtTokens 后调用会话自己的压缩引擎
(ctx.agentPresets.serviceFor(agent, 'compaction'))。插件只决定何时压,
压什么仍由 harness 的引擎决定。
- 提供 optimize 宿主服务(snapshot(id) / list() / flush())。

它不修改系统提示词、工具 schema 与会话前缀,不写任何会话事件,也不碰会话日志。

浏览器侧:渲染减负

聊天视图会为已加载窗口内的每个节点挂一个真实 DOM 行并布局绘制
(只有 trajectory 表做了虚拟滚动)。长会话里这是成千上万行。

- 精简渲染(默认开启、可关):给 [data-chat-anchor-key] 加上
content-visibility: auto 与 contain-intrinsic-size: auto 320px,
滚动区域之外的行不再参与布局与绘制;React 的协调过程不变,
auto 会记住行高,滚动锚点保持稳定。
- 输入框旁的小胶囊:显示当前状态与已挂载行数,点一下即可切换。
- 设置项:同样的开关,位于「设置 → 通用」。

开关状态存在 localStorage 的 dsh-optimize:lite 下。插件不会隐藏或卸载任何一行,
所有内容仍然挂载、可达。

安装

dsh plugin --profile  add dsh-optimize

配置

在 profile 的 patch 层(~/.dsh/profiles//cordis.patch.yml)覆盖默认值:

- id: dsh-optimize
config:
warnTokens: 120000
criticalTokens: 300000
autoCompact: false
compactAtTokens: 200000
compactCooldownMs: 300000
verbose: false

| 键 | 默认 | 含义 |
| --- | --- | --- |
| warnTokens | 120000 | 标记会话变重的请求体量。 |
| criticalTokens | 300000 | 标记会话危急的请求体量。 |
| autoCompact | false | 超预算时调用 harness 压缩引擎。 |
| compactAtTokens | 200000 | 允许自动压缩的体量。 |
| compactCooldownMs | 300000 | 两次自动压缩之间的最小间隔。 |
| verbose | false | 记录每一次请求,而不只是越阈值。 |

关于自动压缩

- 默认关闭,因为它会改变模型看到的内容。内置引擎本来就会在模型窗口将满
(默认比例 0.8)或提供方报上下文溢出时压缩;本选项只是让它更早发生。
- 压缩引擎挂在 agent 预设的 isolate realm 里,唯一受支持的入口是
ctx.agentPresets.serviceFor(agent, 'compaction')。
- 它的阈值在构造时被深冻结:运行期无法调参,要改 thresholdRatio/retainRatio
只能改预设行并重新挂载。
- 压缩需要 agent 空闲;回合进行中的请求会以 busy 被拒,之后重试。

许可

MIT。

上游仓库有新提交时邮件通知你(每天最多一封,无更新不打扰),随时一键退订。

💬 加入 DPharness 群聊

插件用法、部署报错、新插件第一时间同步——群里问,比一个人翻文档快。

点击加入 QQ 群
DPharness 群聊二维码,手机 QQ 扫码进群
扫码进群