DeepSeek Harness Hub
← 返回列表

sjakdhasdh/dsh-vision

DeepSeek Harnessspec-screened在 GitHub 查看 ↗
未验证

dsh-vision 👁️

尚未跑自动兼容性验证,可查看页面内的依赖与入口分析。 · 最近上游提交 2026/8/14 · 已提供中文文档

Vision tool plugin for DeepSeek Harness (DSH): give text-only models like deepseek-v4-flash image recognition via Alibaba Bailian / any OpenAI-compatible vision API. 给 DeepSeek Harness 无识图能力模型加识图工具。

综合分
28
GitHub 分
28
用户评分
★ Stars
2
周下载量
安装插件(需先安装 dsh CLI 引擎:npm install -g @deepseek-ai/dsh)
dsh plugin --profile web add sjakdhasdh/dsh-vision
该插件未发布到 npm,走 GitHub 源安装(pnpm 若拦截 prepare 脚本,按其提示在 pnpm-workspace.yaml 的 allowBuilds 中放行后重跑)
数据截至 2026/9/18(元数据每日更新 · 实装验证按队列轮转,单条结论的验证时间见上方)
依赖的 DSH / Cordis 模块
@deepseek-ai/dsh-tools@deepseek-ai/cordis
用户评分
还没有人投票,来当第一个
订阅周报,不错过优质插件更新
每周一封 · 高评分插件 + 新用户活动

README

dsh-vision 👁️

CI
License: MIT

给 DeepSeek Harness 里没有原生识图能力的模型(如 deepseek-v4-flash)加上识图工具。
为没有原生视觉能力的 DeepSeek Harness 模型(例如 deepseek-v4-flash)赋予图像识别能力。

把本地图片或网络图片 URL 交给视觉大模型(默认阿里云百炼 qwen3.7-flash),返回中文文字描述。
将本地图片路径 / URL 委托给视觉大模型(默认:阿里云百炼 qwen3.7-flash),并返回中文描述。

demo

中文

特性

- 🖼️ 支持本地图片路径、网络图片 URL
- 🔑 OpenAI 兼容格式,不绑定特定厂商(默认阿里云百炼)
- ⚙️ 配置优先级:插件 config > 环境变量 > 默认值
- 📦 零额外运行时依赖(只用 Node 内置 fetch)

安装

pnpm install && pnpm run build
在插件父目录执行:
dsh plugin --profile web add ./dsh-vision
重启 dsh,然后新建会话即可使用 vision 工具

配置

方式一:环境变量

export DASHSCOPE_API_KEY=sk-xxx
export VISION_MODEL=qwen3.7-flash-2026-07-15
export DASHSCOPE_BASE_URL=https://dashscope.aliyuncs.com/compatible-mode/v1

方式二:profile 补丁层 ~/.dsh/profiles//cordis.patch.yml

- id: dsh-vision
config:
apiKey: sk-xxx
model: qwen3.7-flash-2026-07-15
baseURL: https://dashscope.aliyuncs.com/compatible-mode/v1

使用

模型会自动调用 vision 工具,参数:

| 参数 | 必填 | 说明 |
|---|---|---|
| image | ✅ | 本地图片绝对路径(如 C:\a.png)或 http(s) URL |
| prompt | ❌ | 识别要求,默认"请详细描述这张图片的内容" |

提示:配合图片上传

DeepSeek Harness 默认的 DeepSeek adapter 声明模型纯文本,上传图片会被 MODEL_DOES_NOT_SUPPORT_IMAGES 拦截。
要让用户能直接粘贴图片(图片块渲染为 [图片附件: sha256:...] 标记),需要对
dsh-llm-deepseek 打一个小补丁(见 PATCHES.md)。

English

特性

- 🖼️ 支持本地图片路径和远程 http(s) URL
- 🔑 OpenAI 兼容 API —— 厂商无关(默认百炼)
- ⚙️ 配置优先级:插件 config > 环境变量 > 默认值
- 📦 零额外运行时依赖(仅使用内置 fetch)

安装

pnpm install && pnpm run build
在父目录中执行:
dsh plugin --profile web add ./dsh-vision
重启 dsh,然后打开一个新会话 —— vision 工具会出现在模型的工具集中

配置

方式 A —— 环境变量:

export DASHSCOPE_API_KEY=sk-xxx
export VISION_MODEL=qwen3.7-flash-2026-07-15
export DASHSCOPE_BASE_URL=https://dashscope.aliyuncs.com/compatible-mode/v1

方式 B —— profile 补丁层 ~/.dsh/profiles//cordis.patch.yml:

- id: dsh-vision
config:
apiKey: sk-xxx
model: qwen3.7-flash-2026-07-15
baseURL: https://dashscope.aliyuncs.com/compatible-mode/v1

使用

模型会自动调用 vision 工具:

| 参数 | 必填 | 说明 |
|---|---|---|
| image | ✅ | 本地绝对路径(如 C:\a.png)或 http(s) URL |
| prompt | ❌ | 指令;默认为"详细描述这张图片" |

注意:启用图片上传
原版 DeepSeek 适配器声明模型仅支持文本,并以
MODEL_DOES_NOT_SUPPORT_IMAGES 拒绝上传。为了让用户能够直接粘贴图片(渲染为
[图片附件: sha256:...] 标记),请应用 PATCHES.md 中描述的小补丁。

文章 / 相关文章

- 📖 中文实战文章(掘金):给 DeepSeek Harness 加上识图能力:从踩坑到发布开源插件的完整实践
- 📖 同文(CSDN):DeepSeek 模型不识图?开源插件 dsh-vision 让纯文本模型也能"看"图片
- 📖 同文(知乎):DeepSeek 官方智能体框架不识图?我给它写了个开源插件
- 📣 官方 Discussions:Show and tell #876

许可证

MIT

上游仓库有新提交时邮件通知你(每天最多一封,无更新不打扰),随时一键退订。

💬 加入 DPharness 群聊

插件用法、部署报错、新插件第一时间同步——群里问,比一个人翻文档快。

点击加入 QQ 群
DPharness 群聊二维码,手机 QQ 扫码进群
扫码进群