DeepSeek Harness Hub
← 返回列表

poiuyjie/dsh-vision-opencode

DeepSeek Harnessspec-screened在 GitHub 查看 ↗
⚠ 装前注意

DeepSeek 不认图?OpenCode 多模态平替方案:给纯文本主模型加一个可配置的识图模型。

基本兼容但装前注意:未发布到 npm registry,仅可从源码安装 · 最近上游提交 2026/9/9 · 已提供中文文档

DSH 插件:通过任意视觉模型为纯文本 LLM(DeepSeek 等)自动将图像转换为文本。无需切换你的主模型。

综合分
38.8
GitHub 分
38.8
用户评分
★ Stars
13
周下载量
安装插件(需先安装 dsh CLI 引擎:npm install -g @deepseek-ai/dsh)
dsh plugin --profile web add poiuyjie/dsh-vision-opencode
未发布到 npm registry,仅可从源码安装,改用 GitHub 源安装
数据截至 2026/9/17(元数据每日更新 · 实装验证按队列轮转,单条结论的验证时间见上方)
安装兼容性检查⚠ 装前注意

以下结论由程序自动检查 npm 包、engines 声明与入口文件得出,未做人工实机验证——能装不等于用着没问题。

npm 包dsh-vision-opencode(未发布到 npm,仅可源码安装)
Node 引擎要求 >=20.3 · 基线 Node 22.19 满足
dsh CLI 依赖未声明 dsh 版本约束
入口文件main/exports/bin 已声明

未发布到 npm registry,仅可从源码安装

验证方式:npm registry 存在性 + package.json 静态校验 · 最后验证 2026/9/17 16:26:51

依赖的 DSH / Cordis 模块
@deepseek-ai/dsh-llm@deepseek-ai/dsh-tools@deepseek-ai/dsh-settings@deepseek-ai/dsh-skill@deepseek-ai/schemastery
用户评分
还没有人投票,来当第一个
订阅周报,不错过优质插件更新
每周一封 · 高评分插件 + 新用户活动

README

dsh-vision-opencode

中文 | English

DeepSeek 不认图?OpenCode 多模态平替方案:给纯文本主模型加一个可配置的识图模型。

它能做什么

- 聊天里发图 → 先交给视觉模型(如 MiMo-V2.5)转成文字,主模型照常回复,不用换模型
- 输入框右侧「识图模型」下拉,自动列出所有供应商中支持图片的模型
- 设置 → Vision 独立管理模型;vision_read_image 工具 / vision-image-analysis skill 支持 OCR、图表、截图理解
- 异常兜底:单次 60s 超时、失败重试 1 次、重试耗尽降级为占位文本,不拖垮回合

安装

方式一(DSH 原生,推荐):

dsh plugin --profile web add -w github:poiuyjie/dsh-vision-opencode

方式二:一键脚本(Ubuntu install.sh / Windows install.ps1):

curl -fsSL https://raw.githubusercontent.com/poiuyjie/dsh-vision-opencode/main/scripts/install.sh | bash

装完重启 dsh,在输入框右侧选择识图模型。

卸载:dsh plugin --profile web remove -w dsh-vision-opencode(或 uninstall.sh)。

卸载前先备份包含图片的会话——卸载后这些旧会话可能无法再发给纯文本主模型。

配置

编辑 ~/.dsh/settings.yaml(也可用设置 → Vision 图形化管理):

vision-opencode:
provider: ''       # 识图模型供应商;空 = 未选择
model: ''          # 识图模型 id;空 = 未选择
autoConvert: true  # 发图自动转换开关;出问题可改 false 关掉

插件自动识别纯文本主模型并接管图片;原生多模态模型保留 DSH 原生链路,无需改模型目录。

渠道状态圆点

设置 → Vision 的渠道(提供方分组)名称旁有状态圆点,与官方「模型」页同款:

- 🟢 已配置 API 密钥(宿主路由的 apiKeyEnv 或插件写入的 _API_KEY 任一可用即绿)
- 🔴 明确未配置密钥
- 不显示 = 状态未知(凭据服务不可用等)

识图模型的推理关闭

设置 → Vision 里每个模型有一行「推理」策略:

| 选项 | 含义 |
|---|---|
| 默认 | 跟随供应商默认档位,正常思考 |
| 关闭 | 不思考,更快更省;仅当供应商真实声明 off 时提供(如 hy3 off:"none") |
| 强制关闭 | 尽力关掉思考(如 reasoning_effort:"none"),不保证成功;MiMo 这类未声明 off 的只能选这个 |

有「关闭」档的模型很少,没有时界面显示「默认 / 强制关闭」并标注「不保证成功」。关掉思考一般能明显降低首 token 延迟和花费(MiMo 实测 reasoning_effort:"none" 可真正关掉)。

⚠️ 各供应商对「关闭思考」的声明很混乱(off:"none" / off:null / 无字段各不相同),插件只能尽力按厂商目录区分「关闭」与「强制关闭」并试参数,不保证每个供应商都能真正关掉。

常见问题

- 只想关掉自动转换(保留工具和选择器):vision-opencode.autoConvert: false 后重启
- 图片转换异常/选择器不出现:多半是识图模型未选或版本差异,看浏览器控制台报错发 issue
- 纯文本与多模态主模型自动区分,切换供应商无需再改配置

开发规范

- 每次推送必须打 tag:git push 前先创建对应版本的 tag 并推送(如 git tag v0.4.0 && git push origin v0.4.0),保证远端每次更新都有可追溯的版本标记。

License

MIT

上游仓库有新提交时邮件通知你(每天最多一封,无更新不打扰),随时一键退订。

同作者(poiuyjie)的其他插件

💬 加入 DPharness 群聊

插件用法、部署报错、新插件第一时间同步——群里问,比一个人翻文档快。

点击加入 QQ 群
DPharness 群聊二维码,手机 QQ 扫码进群
扫码进群