← 返回列表
未验证
一个 DeepSeek HarnessDSHWeb UI 插件:在对话页右上角Session log 按钮旁添加一个…
尚未跑自动兼容性验证,可查看页面内的依赖与入口分析。 · 最近上游提交 2026/8/16 · 已提供中文文档
DeepSeek Harness Web UI 插件:添加一个“释放 GPU”按钮,通过卸载本地 Ollama 模型来释放显存
综合分
27.1
GitHub 分
27.1
用户评分
—
★ Stars
1
周下载量
—
安装插件(需先安装 dsh CLI 引擎:npm install -g @deepseek-ai/dsh)
dsh plugin --profile web add princepainter/dsh-gpu-cleanup该插件未发布到 npm,走 GitHub 源安装(pnpm 若拦截 prepare 脚本,按其提示在 pnpm-workspace.yaml 的 allowBuilds 中放行后重跑)
信任档位:仅索引本站尚未对其实装验证,仅收录元数据
- 是什么
- dsh 原生插件 · market
- 装得上吗
- 本站尚未做安装检查
- 安全吗
- 本站尚未对该插件做风险分级(暂未覆盖,不等同于无风险)
- 还在维护吗
- 更新放缓:最近一次提交在 40 天前
档位由下列信号合成:本站实装验证(真实安装,当前最高到 L4)· 验证所用 dsh 版本 · 静态安装检查 · 风险分级 · 仓库维护状态。下方各区块是它的证据明细。 验证判据与等级说明 →
数据截至 2026/9/22(元数据每日更新 · 实装验证按队列轮转,单条结论的验证时间见上方)
依赖的 DSH / Cordis 模块
@deepseek-ai/cordis@deepseek-ai/dsh-client-runtime@deepseek-ai/dsh-client-locale@deepseek-ai/dsh-client-ui-slots@deepseek-ai/dsh-client-ui-primitives用户评分
还没有人投票,来当第一个
订阅周报,不错过优质插件更新
每周一封 · 高评分插件 + 新用户活动
README
由 DeepSeek 最新模型翻译生成dsh-gpu-cleanup
一个 DeepSeek Harness(DSH)Web UI 插件:在对话页右上角(Session log 按钮旁)添加一个 「释放显存」 按钮,一键卸载本地 Ollama(及任意 OpenAI 兼容服务)已加载的模型,把 GPU 显存腾出来给 ComfyUI / SDXL / 其他 GPU 任务使用。
典型场景:用 DSH 跑完一个本地模型任务后,模型仍驻留在显存里,直接去开 ComfyUI 会 OOM。点一下按钮即可卸载,无需重启 DSH。
一个 DeepSeek Harness Web UI 插件,在 Session log 按钮旁添加一个 「释放显存」 按钮,按需卸载本地 Ollama(及任意 OpenAI 兼容)模型,为 ComfyUI / SDXL 及其他 GPU 工作负载腾出显存。
功能特性
- 一键释放显存:自动发现本地 LLM 服务,卸载所有已加载模型
- 自动发现:从 DSH 的 settings.yaml 读取 provider 配置,自动识别 Ollama 端点(含 :11434 端口或名字含 ollama)
- 兜底机制:即使配置里没有 Ollama,也会尝试 http://127.0.0.1:11434
- 实时日志:弹窗展示卸载进度,支持复制日志
- 中英双语:跟随 DSH 的 UI 语言自动切换
安装
方式一:dsh plugin 命令(推荐)
dsh plugin --profile web add github:princepainter/dsh-gpu-cleanup
方式二:手动安装
mkdir -p ~/.dsh/profiles/node_modules/@princepainter
cd ~/.dsh/profiles/node_modules/@princepainter
git clone https://github.com/princepainter/dsh-gpu-cleanup.git
然后在 ~/.dsh/profiles/web/cordis.patch.yml 里注册插件:
- insert:
- id: gpu-cleanup
name: '@princepainter/dsh-gpu-cleanup'
重启并刷新
安装后重启 DSH,然后 强制刷新(Ctrl+Shift+R)浏览器页面,即可在对话页右上角看到「释放显存」按钮。
使用
1. 打开 DSH Web UI(http://127.0.0.1:3080)
2. 右上角点击 「释放显存」 按钮
3. 弹窗中点击 「执行」
4. 等待日志显示 done_reason=unload,显存即已释放
工作原理
插件调用 Ollama 的 API 卸载模型:
1. 查询当前已加载的模型
GET http://127.0.0.1:11434/api/ps
2. 对每个模型发送卸载请求(keep_alive: 0 = 立即卸载)
POST http://127.0.0.1:11434/api/generate
{ "model": "qwen3.8-27b:latest", "keep_alive": 0 }
=> { "done": true, "done_reason": "unload" }
Ollama 返回 done_reason: "unload" 即代表模型已从显存卸载。
技术架构
本插件遵循 DSH 的「一切皆插件」架构,是一个 dual-face 包:
| 文件 | 作用 |
|------|------|
| lib/index.js | Node 端占位(host half),保证 Cordis loader 可导入 |
| lib/client.js | 浏览器端(client half),渲染按钮并注入到 conversation.session.header.utilities slot |
| lib/invariant.js | Invariant 占位,满足 DSH dual-face 协议 |
按钮通过 DSH 的 slot 系统注入,与官方「Session log」按钮同属 conversation.session.header.utilities slot,风格自动保持一致。
依赖
- DeepSeek Harness v0.1.0-rc.6(开发者预览版)
- 本地 Ollama(可选,没有 Ollama 时按钮仍会显示,但执行时提示无可用服务)
License
MIT