← 返回列表
未验证
生成冻结清单并拦截受污染评测结果
尚未跑自动兼容性验证,可查看页面内的依赖与入口分析。 · 最近上游提交 2026/8/17 · 已提供中文文档
DeepSeek Harness 的基准测试清单、故障关闭门禁、制品契约与结果完整性技能。
综合分
28.5
GitHub 分
28.5
用户评分
—
★ Stars
2
周下载量
—
安装插件(需先安装 dsh CLI 引擎:npm install -g @deepseek-ai/dsh)
dsh plugin --profile web add LeslieWylie/dsh-benchmark-evidence该插件未发布到 npm,走 GitHub 源安装(pnpm 若拦截 prepare 脚本,按其提示在 pnpm-workspace.yaml 的 allowBuilds 中放行后重跑)
信任档位:已验证本站已于 0 天前真实安装成功
- 是什么
- dsh 原生插件 · chat
- 装得上吗
- 本站已真实安装成功(非静态推断)
- 安全吗
- 本站尚未对该插件做风险分级(暂未覆盖,不等同于无风险)
- 还在维护吗
- 更新放缓:最近一次提交在 40 天前
档位由下列信号合成:本站实装验证(真实安装,当前最高到 L4)· 验证所用 dsh 版本 · 静态安装检查 · 风险分级 · 仓库维护状态。下方各区块是它的证据明细。 验证判据与等级说明 →
🟢实装验证通过· 2026/9/25
由本站实装验证器在真实 dsh 环境安装成功,非静态推断。
数据截至 2026/9/16(元数据每日更新 · 实装验证按队列轮转,单条结论的验证时间见上方)
依赖的 DSH / Cordis 模块
@deepseek-ai/cordis@deepseek-ai/dsh-skill@deepseek-ai/dsh-tools用户评分
还没有人投票,来当第一个
订阅周报,不错过优质插件更新
每周一封 · 高评分插件 + 新用户活动
README
由 DeepSeek 最新模型翻译生成dsh-benchmark-evidence 面向 DeepSeek Harness 的 benchmark 证据和完整性门禁,泛化 Harbor/Terminal-Bench 周边的运行清单、fail-closed preflight、产物清单、结果完整性、清理和错误分桶设计。 - dsh_benchmark_manifest:生成冻结身份清单,不启动评测。 - dsh_benchmark_gate:区分 clean candidate 与 incomplete/contaminated 结果。 npm install dsh-benchmark-evidence 或:pnpm add dsh-benchmark-evidence 插件不会启动 benchmark、处理凭据、上传产物或修改运行目录。