← 返回列表
未验证
将同一个提示词跑遍你拥有的所有模型,无需眯眼细看即可看出差异。
尚未跑自动兼容性验证,可查看页面内的依赖与入口分析。 · 最近上游提交 2026/9/19 · 已提供中文文档
综合分
29.3
GitHub 分
29.3
用户评分
—
★ Stars
0
周下载量
—
兼容 / 相关生态插件(非 dsh 原生,请按其对应运行时安装)
git clone https://github.com/hj01857655/dsh-model-arena.git信任档位:已验证本站已于 0 天前真实安装成功
- 是什么
- 生态应用(桌面端 / Web 外壳,不以 dsh plugin add 安装)
- 装得上吗
- 本站已真实安装成功(非静态推断)
- 安全吗
- 本站尚未对该插件做风险分级(暂未覆盖,不等同于无风险)
- 还在维护吗
- 活跃:最近一次提交在 6 天前
档位由下列信号合成:本站实装验证(真实安装,当前最高到 L4)· 验证所用 dsh 版本 · 静态安装检查 · 风险分级 · 仓库维护状态。下方各区块是它的证据明细。 验证判据与等级说明 →
🟢实装验证通过· 2026/9/26
由本站实装验证器在真实 dsh 环境安装成功,非静态推断。
数据截至 2026/9/26(元数据每日更新 · 实装验证按队列轮转,单条结论的验证时间见上方)
依赖的 DSH / Cordis 模块
@deepseek-ai/cordis用户评分
还没有人投票,来当第一个
订阅周报,不错过优质插件更新
每周一封 · 高评分插件 + 新用户活动
README
由 DeepSeek 最新模型翻译生成dsh-model-arena npm version npm downloads CI license node GitHub stars dsh plugin 将同一个提示词跑遍你拥有的所有模型,无需眯眼细看即可看出差异。 安装 dsh plugin --profile web add dsh-model-arena 功能 - 将提示词跑遍 N 个模型。 相同的提示词、完全一致的参数,输出并排收集。 - 对比。 任意两个模型输出之间的行级差异。 - 评分。 自动评分器(长度、延迟、参考匹配)+ 人工用户评分(1-5)。 - 基准测试套件。 保存一组命名的提示词 + 模型,在更改后重新运行,获得回归报告。 - 面板。 设置页面列出最近的运行记录,可下钻到对比视图。 CLI dsh-model-arena list # 列出最近的运行记录 dsh-model-arena compare # 对比一次运行中的两个模型 dsh-model-arena rate --model M --rating 4 # 为某个模型输出评分 许可证 MIT