DeepSeek Harness Hub
← 返回列表

视觉副模型桥接woyeshishen/dsh-vision-plugin

DeepSeek Harnessspec-screened在 GitHub 查看 ↗
未验证

让纯文本主模型调用外部视觉模型描述图片内容

尚未跑自动兼容性验证,可查看页面内的依赖与入口分析。 · 最近上游提交 2026/8/15 · 已提供中文文档
综合分
28.3
GitHub 分
28.3
用户评分
★ Stars
2
周下载量
安装插件(需先安装 dsh CLI 引擎:npm install -g @deepseek-ai/dsh)
dsh plugin --profile web add woyeshishen/dsh-vision-plugin
该插件未发布到 npm,走 GitHub 源安装(pnpm 若拦截 prepare 脚本,按其提示在 pnpm-workspace.yaml 的 allowBuilds 中放行后重跑)
数据截至 2026/9/16(元数据每日更新 · 实装验证按队列轮转,单条结论的验证时间见上方)
依赖的 DSH / Cordis 模块
@deepseek-ai/cordis@deepseek-ai/dsh-tools@deepseek-ai/dsh-settings@deepseek-ai/dsh-credentials@deepseek-ai/dsh-llm@deepseek-ai/dsh-attachment@deepseek-ai/dsh-fs@deepseek-ai/dsh-client-connection@deepseek-ai/dsh-client-runtime@deepseek-ai/dsh-client-ui-settings@deepseek-ai/dsh-client-ui-slots@deepseek-ai/dsh-api-remotes
用户评分
还没有人投票,来当第一个
订阅周报,不错过优质插件更新
每周一封 · 高评分插件 + 新用户活动

README

dsh-vision-plugin

npm version
license

为 DeepSeek Harness(DSH)补齐看图能力:接入一个 OpenAI 兼容的外部视觉模型后,纯文本主模型(如 deepseek)即可通过 describe_image 工具把图片交给它、拿到纯文字描述,从而理解截图、照片、图表、OCR、界面等内容。

设计原则:图片只发给副模型(外部视觉模型),主模型始终只处理文字。

特性

| | |
| --- | --- |
| 🖼️ 看图 | 主模型调用 describe_image,返回纯文字描述 |
| ⚙️ 图形化配置 | 在设置页填 URL / API key / 模型,无需手改配置文件 |
| 🔒 凭据安全 | API key 加密存储于凭据库,界面永不回显 |
| 📦 一次安装,长期有效 | 随 DSH 启动自动加载,重启不丢 |

安装

一键安装(推荐)

Windows(PowerShell)

irm https://raw.githubusercontent.com/woyeshishen/dsh-vision-plugin/main/scripts/install.ps1 | iex

macOS / Linux

sh
bash  看一下 D:\path\to\image.png,描述里面的内容

主模型会自动调用 describe_image,把图片发给外部视觉模型,拿到文字描述后继续推理。

工具

describe_image

| 参数 | 必填 | 说明 |
| --- | --- | --- |
| path | ✅ | 图片文件路径;支持 png / jpg / jpeg / webp / gif |
| prompt | ❌ | 对图片的具体问题;缺省为「详细描述图片内容」 |

要求

- DeepSeek Harness
- 一个 OpenAI 兼容(/chat/completions)、支持图像输入的外部视觉模型

License

Apache-2.0

上游仓库有新提交时邮件通知你(每天最多一封,无更新不打扰),随时一键退订。

💬 加入 DPharness 群聊

插件用法、部署报错、新插件第一时间同步——群里问,比一个人翻文档快。

点击加入 QQ 群
DPharness 群聊二维码,手机 QQ 扫码进群
扫码进群