DeepSeek Harness Hub
← 返回列表

视觉适配器kulebbb/dsh-vision

DeepSeek Harnessspec-screened在 GitHub 查看 ↗
未验证

把图片转成文字描述,让纯文本模型也能看图

尚未跑自动兼容性验证,可查看页面内的依赖与入口分析。 · 最近上游提交 2026/8/17 · 已提供中文文档

通过 OpenAI 兼容的视觉模型描述图像,为纯文本 DeepSeek 模型赋予视觉能力(DSH 插件)

综合分
27.7
GitHub 分
27.7
用户评分
★ Stars
1
周下载量
安装插件(需先安装 dsh CLI 引擎:npm install -g @deepseek-ai/dsh)
dsh plugin --profile web add kulebbb/dsh-vision
该插件未发布到 npm,走 GitHub 源安装(pnpm 若拦截 prepare 脚本,按其提示在 pnpm-workspace.yaml 的 allowBuilds 中放行后重跑)
数据截至 2026/9/16(元数据每日更新 · 实装验证按队列轮转,单条结论的验证时间见上方)
依赖的 DSH / Cordis 模块
@deepseek-ai/cordis@deepseek-ai/dsh-anonymous-user-id@deepseek-ai/dsh-credentials@deepseek-ai/dsh-launch-environment@deepseek-ai/dsh-llm@deepseek-ai/dsh-llm-deepseek@deepseek-ai/dsh-settings@deepseek-ai/dsh-tools@deepseek-ai/schemastery
用户评分
还没有人投票,来当第一个
订阅周报,不错过优质插件更新
每周一封 · 高评分插件 + 新用户活动

README

@kulebbb/dsh-vision

为没有视觉能力的 DeepSeek 模型补齐视觉能力:把发给模型的图片块调一个 OpenAI 兼容视觉模型转成文字描述,再交给纯文本模型。参考 ErlichLiu/deepseek-vision 的核心机制,以 DSH 原生适配器插件实现。

仓库: · npm:

结构

| 文件 | 职责 |
|---|---|
| lib/index.js | apply(ctx, config):注册 deepseek-vision 适配器 + describe_image 工具 |
| lib/adapter.js | VisionDeepSeekAdapter extends DeepSeekAdapter:声明 image 输入,stream() 里图片→文字 |
| lib/vision.js | describeImage():OpenAI 兼容 chat/completions 视觉调用 |
| lib/rewrite.js | collectImages / mapImages 纯变换 |
| lib/tool.js | describe_image 工具定义 |
| lib/client.js | Browser half:Settings 里的「视觉/Vision」配置页 |

安装(web profile)

cd ~/.dsh/profiles/web
pnpm add @kulebbb/dsh-vision

在 cordis.patch.yml 的 insert 列表追加(config 可按需覆盖):

- insert:
- id: dsh-vision
name: '@kulebbb/dsh-vision'
config:
deepseek:
apiKeyEnv: DEEPSEEK_API_KEY
vision:
baseUrl: https://dashscope.aliyuncs.com/compatible-mode/v1
model: qwen-vl-max
apiKeyEnv: VISION_API_KEY

然后重启 dsh web。

也可以直接从 GitHub 安装(不经过 npm registry):pnpm add github:kulebbb/dsh-vision。

依赖的 @deepseek-ai/ 运行库由 DSH 安装自带(peer 依赖已标为 optional,安装时无需也不可单独拉取),本插件无需额外安装任何依赖。

🤖 Agent 一键安装

把下面任一段提示词(中文或英文)复制发给你的 AI 助手(DeepSeek / Claude / Cursor 等),它会自动完成安装。如需同时安装 dsh-git-tree,把两个插件的提示词一起发给助手,它会依次完成。

中文版

你是一个安装助手。请帮我把 DSH(DeepSeek Harness)插件 @kulebbb/dsh-vision 安装到我的 web profile 中,并完成配置。

【背景】
@kulebbb/dsh-vision 是 DSH 适配器插件,为纯文本 DeepSeek 模型补齐视觉能力:把发给模型的图片转成文字描述,再交给文本模型。它依赖的 @deepseek-ai/ 运行库由 DSH 安装自带,无需(也无法)单独安装。

【前置检查】
1. 运行 dsh --version 确认 DSH 已安装;若命令不存在,告诉我"未检测到 dsh,需要先安装 DSH"并停止。
2. 确认目录 ~/.dsh/profiles/web(或 $DSH_HOME/profiles/web)存在;若不存在,先运行 dsh web 完成首次初始化。

【安装步骤】
1. cd ~/.dsh/profiles/web
2. 运行:pnpm add @kulebbb/dsh-vision
3. 打开(或创建)cordis.patch.yml,在顶层 insert 列表【末尾追加】以下条目。注意:片段中的 - insert: 是文件的顶层列表项,写入时必须顶格(去掉每行前导空格),片段内部缩进保持不变;不要覆盖或改动其他已有条目;若已存在 id 为 dsh-vision 的条目,只更新它的 name 和 config:
- insert:
- id: dsh-vision
name: '@kulebbb/dsh-vision'
config:
deepseek:
apiKeyEnv: DEEPSEEK_API_KEY
vision:
baseUrl: https://dashscope.aliyuncs.com/compatible-mode/v1
model: qwen-vl-max
apiKeyEnv: VISION_API_KEY
说明:apiKeyEnv 是凭据引用名。请提醒我在环境变量或 $DSH_HOME/.credentials.yaml 中准备好 DEEPSEEK_API_KEY 和 VISION_API_KEY;不要把真实密钥写进 yaml 文件。
4. 重启 dsh web(若正在运行)。

【验证】
- 运行 dsh --profile web --dump-config,确认输出包含 id: dsh-vision 与 name: '@kulebbb/dsh-vision'。
- 重启后:Settings 出现「视觉 / Vision」配置页;模型选择器出现 deepseek-vision provider;粘贴图片不再报「select an image-capable model」。

【异常处理】
- 任何命令报错,把完整错误信息原样转达给我,不要擅自修改配置或改用其他方案。
- 若 pnpm 报 peer 依赖相关错误(如 ERR_PNPM_FETCH_404),可尝试:pnpm add @kulebbb/dsh-vision --config.auto-install-peers=false,然后重试;正常情况下不需要。
- 若你没有执行命令的能力,请把上述命令与 yaml 片段整理成一份手动操作清单交给我。
- 需要我确认的信息(如 API Key 的获取方式)先问我,再继续。

英文

你是一名安装助手。请将 DSH(DeepSeek Harness)插件 @kulebbb/dsh-vision 安装到我的 web profile 中并进行配置。

[背景]
@kulebbb/dsh-vision 是一个 DSH 适配器插件,它通过一个 OpenAI 兼容的视觉模型来描述图像,从而为纯文本的 DeepSeek 模型赋予视觉能力。它的 @deepseek-ai/* 运行时依赖由 DSH 安装本身提供——不要(也无法)单独安装它们。

[预检]
1. 运行 dsh --version 以确认 DSH 已安装;如果该命令不存在,请告诉我“dsh 未安装”并停止。
2. 确认目录 ~/.dsh/profiles/web(或 $DSH_HOME/profiles/web)存在;如果不存在,请运行一次 dsh web 来初始化它。

[安装]
1. cd ~/.dsh/profiles/web
2. 运行:pnpm add @kulebbb/dsh-vision
3. 打开(或创建)cordis.patch.yml,并将以下条目追加到顶层 insert 列表。注意:- insert: 是该文件的顶层列表项——请将其顶格书写(去掉每一行的前导空白),同时保持内部缩进不变;不要覆盖或修改其他条目。如果已存在 id 为 dsh-vision 的条目,只更新其 name 和 config:
- insert:
- id: dsh-vision
name: '@kulebbb/dsh-vision'
config:
deepseek:
apiKeyEnv: DEEPSEEK_API_KEY
vision:
baseUrl: https://dashscope.aliyuncs.com/compatible-mode/v1
model: qwen-vl-max
apiKeyEnv: VISION_API_KEY
注意:apiKeyEnv 是凭据引用名称。请提醒我通过环境变量或 $DSH_HOME/.credentials.yaml 提供 DEEPSEEK_API_KEY 和 VISION_API_KEY;切勿将真实密钥写入 yaml 文件。
4. 重启 dsh web(如果它正在运行)。

[验证]
- 运行 dsh --profile web --dump-config,并确认输出中包含 id: dsh-vision 和 name: '@kulebbb/dsh-vision'。
- 重启后:设置中会显示一个“Vision”部分;模型选择器会提供 deepseek-vision 提供方;粘贴图像时不再报错“select an image-capable model”。

[出错时]
- 如果任何命令失败,请将完整错误原样转达给我;不要自行更改配置或改用其他方法。
- 如果 pnpm 报告 peer-dependency 错误(例如 ERR_PNPM_FETCH_404),请使用以下命令重试:pnpm add @kulebbb/dsh-vision --config.auto-install-peers=false(通常不需要)。
- 如果你无法运行命令,请改为交给我一份分步手动操作清单。
- 每当你需要我尚未提供的信息(例如如何获取 API Key)时,请先问我再继续。

配置

| 字段 | 默认值 | 说明 |
|---|---|---|
| deepseek.baseURL | https://api.deepseek.com | DeepSeek 端点 |
| deepseek.apiKeyEnv | DEEPSEEK_API_KEY | DeepSeek 密钥 credential ref |
| deepseek.models | deepseek-v4-pro / deepseek-v4-flash | 暴露的模型目录 |
| vision.baseUrl | https://api.openai.com/v1 | 视觉端点(OpenAI 兼容) |
| vision.model | gpt-4o-mini | 视觉模型名 |
| vision.apiKeyEnv | VISION_API_KEY | 视觉密钥凭据引用 |
| vision.timeoutMs | 60000 | 单次视觉调用超时 |
| vision.maxImages | 5 | 单请求最多描述的图片数 |

密钥经 ctx.credentials 按 ref 每次解析(存环境变量或 $DSH_HOME/.credentials.yaml),不进配置。

Settings UI:重启后,打开 DSH 的 Settings 会出现「视觉 / Vision」页,可在其中直接编辑 vision.baseUrl / vision.model / vision.apiKeyEnv / vision.timeoutMs / vision.maxImages 以及 API Key(key 作为凭据写入,不进设置文件)。端点/模型等字段保存后即时生效(无需重启),API Key 也即时生效。

使用

- 在模型选择器选 deepseek-vision provider(模型名不变)。之后在输入框粘贴图片,模型收到的会是 [Image N]  文本,不再报「select an image-capable model」。
- 让模型主动「看」工作区图片:describe_image 工具,参数 image(绝对路径或 URL)+ 可选 question。

测试

cd plugins/dsh-vision && node --test

License

MIT

上游仓库有新提交时邮件通知你(每天最多一封,无更新不打扰),随时一键退订。

同作者(kulebbb)的其他插件

💬 加入 DPharness 群聊

插件用法、部署报错、新插件第一时间同步——群里问,比一个人翻文档快。

点击加入 QQ 群
DPharness 群聊二维码,手机 QQ 扫码进群
扫码进群