DeepSeek Harness Hub
← 返回列表

dami9527/dsh-image-pathify

DeepSeek Harnessspec-screened在 GitHub 查看 ↗
✓ 可直接安装

DeepSeek Harness 插件:让 deepseek-v4-flash…

自动检查通过:npm 包已发布且 engines 声明满足基线(声明 Node >=22);该结论来自程序自动检查,未经人工实机验证。 · 最近上游提交 2026/9/10 · 已提供中文文档

DeepSeek Harness 插件:让 deepseek-v4-flash 等不能看图的模型也能处理聊天图片,内置识图工具。安装:dsh plugin --profile web add dsh-image-pathify

综合分
32.1
GitHub 分
32.1
用户评分
★ Stars
4
周下载量
安装插件(需先安装 dsh CLI 引擎:npm install -g @deepseek-ai/dsh)
dsh plugin --profile web add dsh-image-pathify
npm 包 dsh-image-pathify 已校验归属本仓库,走 npm 安装最省事
数据截至 2026/9/19(元数据每日更新 · 实装验证按队列轮转,单条结论的验证时间见上方)
安装兼容性检查✓ 自动检查通过

以下结论由程序自动检查 npm 包、engines 声明与入口文件得出,未做人工实机验证——能装不等于用着没问题。

npm 包dsh-image-pathify @ 0.1.9
Node 引擎要求 >=22 · 基线 Node 22.19 满足
dsh CLI 依赖未声明 dsh 版本约束
入口文件main/exports/bin 已声明

验证方式:npm registry 存在性 + package.json 静态校验 · 最后验证 2026/9/19 01:13:02

依赖的 DSH / Cordis 模块
@deepseek-ai/cordis@deepseek-ai/schemastery@deepseek-ai/dsh-llm@deepseek-ai/dsh-attachment@deepseek-ai/dsh-home-paths
用户评分
还没有人投票,来当第一个
订阅周报,不错过优质插件更新
每周一封 · 高评分插件 + 新用户活动

README

dsh-image-pathify

需要 DeepSeek Harness >= 0.1.1-rc.1(已在 0.1.5-rc.1 验证)。更早的宿主请继续使用 dsh-image-pathify@0.1.8。

让 deepseek-v4 这类「不能看图」的模型,也能处理你贴进聊天里的图片,并直接调用插件内置的识图工具。

聊天记录和界面里的缩略图不会变。插件只在把消息发给模型前,把图片换成一行本地文件路径;模型再调用 analyze_image 读这个文件,通过你配置的视觉 API 得到文字描述。

你贴一张图  →  聊天里照常显示缩略图
↓
发给不能看图的模型前  →  变成:Saved attachments: /某路径/某文件
↓
模型调用 analyze_image  →  视觉 API 返回文字描述(多张图一次请求、同一次看见全部)

已经能看图的模型不受影响:图片会原样发给它们,analyze_image 不会出现在它们的工具列表和系统提示里。read_image 在不能看图的模型上会被拒绝,并提示改用 analyze_image。

磁盘上的图片文件是 dsh 自己保存的附件(~/.dsh/attachments/v1/...),不是本插件另存的一份。

安装

dsh plugin --profile web add dsh-image-pathify
dsh web

打开 设置 → 插件 → 识图,填写后点保存:

- API 密钥(写入 $DSH_HOME/.credentials.yaml,不进设置文件)
- 识图模型(默认 deepseek-flash)
- 识图 API 地址(默认 https://api.deepseek.com)
- 禁用思考(默认勾选)。DeepSeek 识图模型(如 deepseek-flash)默认会思考,思考 token 计入输出上限;取消勾选才会走思考模式,开启思考时应增大输出上限

任何 OpenAI 兼容的视觉接口都可以,把地址(部分地址需要后面加/v1)和模型改成你的服务即可。设置页改动保存后立即生效,不用重启。

设置 → 插件 → 识图

更新

已装版本落后于 npm 最新版时,识图卡片 header会显示「发现新版本 x → y」和 复制升级命令,点按钮把命令复制到剪贴板。命令里的 --profile 按当前进程解析,取不到兜底 web。

更新

1. 结束当前正在跑的dsh,例如: dsh web(终端里 Ctrl+C)
2. 执行复制出来的命令:

dsh plugin --profile web add dsh-image-pathify@version

再启动 dsh web

怎么确认可用

1. 设置 → 插件里出现 识图 卡片
2. 给不能看图的模型发一张图:界面里缩略图还在;模型调用 analyze_image 而不是 read_image
3. 给不能看图的模型发本地图片路径或图片URL:应直接调用 analyze_image,不会先 read_image
4. 给能看图的模型发一张图:模型直接回答,不调用 analyze_image
5. 给能看图的模型发本地图片路径或图片URL:应直接调用 read_image,不会先 analyze_image

给不能看图的模型发图,模型调用 analyze_image

配置

设置页保存后立即生效。识图字段写在 $DSH_HOME/settings.yaml 的 image-pathify 段;API 密钥写在 $DSH_HOME/.credentials.yaml,不进设置文件。

| 选项              | 默认                       | 做什么                                                                                                                                               |
| ----------------- | -------------------------- | ---------------------------------------------------------------------------------------------------------------------------------------------------- |
| apiKeyEnv       | IMAGE_PATHIFY_API_KEY    | 凭据引用名。密钥本身写在 $DSH_HOME/.credentials.yaml,不进设置文件                                                                                 |
| visionModel     | deepseek-flash           | 识图模型 id。                                                                                                                                        |
| visionBaseUrl   | https://api.deepseek.com | OpenAI 兼容基址。(部分地址需要后面加/v1)                                                                                                             |
| disableThinking | true                     | 默认勾选。仅 DeepSeek 等支持 thinking 的接口会带上该字段,如果需要思考和详细输出请取消勾选,并增大输出上限,防止输出内容被截断(思考也会占用tokens) |
| maxTokens       | 2048                     | 输出上限。0 = 不传 max_tokens(不传时各家默认值处理方式并不统一)                                                                                  |
| models          | 空 = 全部不能看图的模型    | 只决定哪些模型允许发图。空 = 都能发。填了就只放行名单里的模型                                                                                    |
| relaxAdmission  | true                     | 允许给不能看图的模型发图。关闭后按模型能力拒绝贴图                                                                                                   |

apiKeyEnv 未配置时默认指向 IMAGE_PATHIFY_API_KEY,将 API Key 指向官方环境变量的例子:

image-pathify:
visionModel: deepseek-flash
visionBaseUrl: https://api.deepseek.com
apiKeyEnv: DEEPSEEK_API_KEY

只允许 deepseek-v4 发图的例子:

image-pathify:
models:
- provider: deepseek-official
model: deepseek-v4-flash
- provider: deepseek-official
model: deepseek-v4-pro

用千问 DashScope 识图:

image-pathify:
visionModel: qwen-vl-plus
visionBaseUrl: https://dashscope.aliyuncs.com/compatible-mode/v1

模型侧只多一个工具 analyze_image(仅不能看图的模型能看见、能调用,防止与具备识图能力的模型冲突)。

- 一张图:image 填本地绝对路径或 http(s) 图片 URL(不要带路径前缀)
- 多张图:用 images 一次传入全部路径,插件会在同一次视觉请求里带上所有图片,不必一张一张等
- prompt 可选

同一轮里有多张图时,系统提示会要求模型把所有路径放进一次 analyze_image 调用,而不是循环调用。

开发与构建

pnpm install
pnpm check

pnpm check 会按顺序执行 typecheck、test、build。

License

MIT

上游仓库有新提交时邮件通知你(每天最多一封,无更新不打扰),随时一键退订。

💬 加入 DPharness 群聊

插件用法、部署报错、新插件第一时间同步——群里问,比一个人翻文档快。

点击加入 QQ 群
DPharness 群聊二维码,手机 QQ 扫码进群
扫码进群