← 返回列表
未验证
面向 DeepSeek Harness 的长会话资源治理插件。
尚未跑自动兼容性验证,可查看页面内的依赖与入口分析。 · 最近上游提交 2026/9/14 · 已提供中文文档
DeepSeek Harness 的长会话资源控制:测量每次请求携带的上下文,在可配置阈值处发出警告,可在超出预算时运行 harness 压缩引擎,并将屏幕外的聊天行收纳在开关之后。
综合分
29.7
GitHub 分
29.7
用户评分
—
★ Stars
0
周下载量
—
安装插件(需先安装 dsh CLI 引擎:npm install -g @deepseek-ai/dsh)
dsh plugin --profile web add aoripus/dsh-optimize该插件未发布到 npm,走 GitHub 源安装(pnpm 若拦截 prepare 脚本,按其提示在 pnpm-workspace.yaml 的 allowBuilds 中放行后重跑)
数据截至 2026/9/17(元数据每日更新 · 实装验证按队列轮转,单条结论的验证时间见上方)
用户评分
还没有人投票,来当第一个
订阅周报,不错过优质插件更新
每周一封 · 高评分插件 + 新用户活动
README
dsh-optimize 面向 DeepSeek Harness 的长会话资源治理插件。 一个不断变长的会话,在压缩真正发生之前就已经很贵了:每一步都要重发保留的历史, 会话日志无限增长,浏览器也要为越来越多的历史付出绘制成本。dsh-optimize 把这种增长变成看得见的数字,并在你设定的预算上采取行动。 宿主侧:测量与阈值 - 在每次 agent/pre-step 上用 tokenMeter.measure() 量出这次请求真正携带的上下文, 同时读取 harness 自己的 contextPressure 投影(O(1))作为对照。 - 按会话累计:请求数、事件数、当前/峰值 token、模型窗口、压缩次数、测量来源 (tokenMeter / contextPressure / 估算),写入 $DSH_HOME/storages/dsh-optimize/state.json。 - 首次越过 warnTokens、以及越过 criticalTokens 时各告警一次。 - 可选(默认关闭):越过 compactAtTokens 后调用会话自己的压缩引擎 (ctx.agentPresets.serviceFor(agent, 'compaction'))。插件只决定何时压, 压什么仍由 harness 的引擎决定。 - 提供 optimize 宿主服务(snapshot(id) / list() / flush())。 它不修改系统提示词、工具 schema 与会话前缀,不写任何会话事件,也不碰会话日志。 浏览器侧:渲染减负 聊天视图会为已加载窗口内的每个节点挂一个真实 DOM 行并布局绘制 (只有 trajectory 表做了虚拟滚动)。长会话里这是成千上万行。 - 精简渲染(默认开启、可关):给 [data-chat-anchor-key] 加上 content-visibility: auto 与 contain-intrinsic-size: auto 320px, 滚动区域之外的行不再参与布局与绘制;React 的协调过程不变, auto 会记住行高,滚动锚点保持稳定。 - 输入框旁的小胶囊:显示当前状态与已挂载行数,点一下即可切换。 - 设置项:同样的开关,位于「设置 → 通用」。 开关状态存在 localStorage 的 dsh-optimize:lite 下。插件不会隐藏或卸载任何一行, 所有内容仍然挂载、可达。 安装 dsh plugin --profile add dsh-optimize 配置 在 profile 的 patch 层(~/.dsh/profiles//cordis.patch.yml)覆盖默认值: - id: dsh-optimize config: warnTokens: 120000 criticalTokens: 300000 autoCompact: false compactAtTokens: 200000 compactCooldownMs: 300000 verbose: false | 键 | 默认 | 含义 | | --- | --- | --- | | warnTokens | 120000 | 标记会话变重的请求体量。 | | criticalTokens | 300000 | 标记会话危急的请求体量。 | | autoCompact | false | 超预算时调用 harness 压缩引擎。 | | compactAtTokens | 200000 | 允许自动压缩的体量。 | | compactCooldownMs | 300000 | 两次自动压缩之间的最小间隔。 | | verbose | false | 记录每一次请求,而不只是越阈值。 | 关于自动压缩 - 默认关闭,因为它会改变模型看到的内容。内置引擎本来就会在模型窗口将满 (默认比例 0.8)或提供方报上下文溢出时压缩;本选项只是让它更早发生。 - 压缩引擎挂在 agent 预设的 isolate realm 里,唯一受支持的入口是 ctx.agentPresets.serviceFor(agent, 'compaction')。 - 它的阈值在构造时被深冻结:运行期无法调参,要改 thresholdRatio/retainRatio 只能改预设行并重新挂载。 - 压缩需要 agent 空闲;回合进行中的请求会以 busy 被拒,之后重试。 许可 MIT。
扫码进群