← 返回列表
✓ 可直接安装
DeepSeek Harness 插件:为 DeepSeek 模型桥接 Google Gemini…
自动检查通过:npm 包已发布且 engines 声明满足基线(声明 Node >=18);该结论来自程序自动检查,未经人工实机验证。 · 最近上游提交 2026/8/27 · 已提供中文文档
DeepSeek Harness 一体化:无需切换模型——常规 DeepSeek 自动路由到视觉与图像生成。多后端:Gemini + 任意 OpenAI 兼容(GPT-4o、Qwen-VL、GLM-4V、gpt-image、DALL-E、Flux、OpenRouter)。gemini_vision/gemini_generate_image/gemini_optimize_image 具备视觉自检。优于 modlens。
综合分
33.8
GitHub 分
33.8
用户评分
—
★ Stars
3
周下载量
—
安装插件(需先安装 dsh CLI 引擎:npm install -g @deepseek-ai/dsh)
dsh plugin --profile web add dsh-vision-imagennpm 包 dsh-vision-imagen 已校验归属本仓库,走 npm 安装最省事
信任档位:已验证本站已于 4 天前真实安装成功(L4 · 真实安装)
- 是什么
- dsh 原生插件 · vision
- 装得上吗
- 本站已真实安装成功(L4 · 真实安装,非静态推断)
- 安全吗
- 本站尚未对该插件做风险分级(暂未覆盖,不等同于无风险)
- 还在维护吗
- 活跃:最近一次提交在 29 天前
档位由下列信号合成:本站实装验证(真实安装,当前最高到 L4)· 验证所用 dsh 版本 · 静态安装检查 · 风险分级 · 仓库维护状态。下方各区块是它的证据明细。 验证判据与等级说明 →
🟢实装验证通过· 2026/9/22
由本站实装验证器在真实 dsh 环境安装成功,非静态推断。
数据截至 2026/9/20(元数据每日更新 · 实装验证按队列轮转,单条结论的验证时间见上方)
安装兼容性检查✓ 自动检查通过
以下结论由程序自动检查 npm 包、engines 声明与入口文件得出,未做人工实机验证——能装不等于用着没问题。
✓npm 包dsh-vision-imagen @ 1.3.0
✓Node 引擎要求 >=18 · 基线 Node 22.19 满足
✓dsh CLI 依赖未声明 dsh 版本约束
✓入口文件main/exports/bin 已声明
验证方式:npm registry 存在性 + package.json 静态校验 · 最后验证 2026/9/20 11:27:43
依赖的 DSH / Cordis 模块
@deepseek-ai/dsh-tools用户评分
还没有人投票,来当第一个
订阅周报,不错过优质插件更新
每周一封 · 高评分插件 + 新用户活动
README
由 DeepSeek 最新模型翻译生成dsh-vision-imagen GitHub stars npm version npm downloads npm GitHub license GitHub last commit Node version English DeepSeek Harness 插件:为 DeepSeek 模型桥接 Google Gemini 的多模态识别与图像生成。 当 DeepSeek 模型需要看图、生图、改图时,自动调用 Gemini: | 工具 | 作用 | | --- | --- | | vision_read | 识别/读取/描述/分析图片(OCR、物体、图表),支持本地路径或 http(s) URL | | generate_image | 文本生图,生成后必定用 Gemini 视觉模型自检反馈(不达标时按优化 prompt 重绘) | | edit_image | 改图/优化已有图片:先分析原图 → 生成改进版 → 自检迭代 | ✨ 核心卖点:全能一体,无需切换模型 - 一个 DeepSeek 会话搞定一切:直接用常规 DeepSeek 模型(不必换成视觉模型),需要看图、生图、改图时,插件自动路由到对应的 Gemini 多模态/生图模型——全程零手动切换模型。 - 比 modlens 等更完整:modlens 只是「给纯文本模型装一只读图的眼睛」;本插件是视觉识别 + 图像生成 + 图像编辑 + 自检反馈的完整闭环,并且直接复用你自己的 Gemini API Key,不依赖任何第三方桥接、无额外订阅。 - 自动调用,无需操心:识别 → vision_read;生图 → generate_image;改图 → edit_image。DeepSeek 模型通过系统提示与工具描述自动选对工具,对用户完全透明。 - 自检闭环,质量把关:生成/优化后,自动用 Gemini 视觉模型检查成品图,不达标按优化提示自动重绘,并把检查结论(画面描述 / 达标与否 / 问题清单)直接反馈出来。 🧩 环境要求(依赖) | 依赖 | 要求 | 说明 | | --- | --- | --- | | DeepSeek Harness(dsh) | ≥ 0.1.0-rc.7(rc 通道) | 插件宿主。先全局安装 dsh,再用 dsh plugin --profile web add ... 加载本插件 | | Node.js | ≥ 18 | 宿主半运行环境(engines) | | @deepseek-ai/dsh-tools | peer 依赖() | 必需:宿主半通过 defineTool 注册工具。由 dsh 宿主提供,或随 pnpm install 自动解析——无需手动安装 | | react | ^18.2.0(peer) | 浏览器半(设置页)所需,由 dsh Web 前端提供 | | @deepseek-ai/dsh-client-runtime | rc 通道 | 客户端核心服务,声明于 dsh.client.inject,dsh Web 构建时自动注入 | | 后端 API Key | 自备 | Gemini(Google AI Studio 免费 Key)或所选 OpenAI 兼容后端 | 本插件运行时只依赖 @deepseek-ai/dsh-tools(宿主半)与 react(浏览器半),其余均为 Node.js 内置模块;@deepseek-ai/ 其余包由 dsh 宿主自带,不会重复安装。已实测:dsh 0.1.0-rc.7 + @deepseek-ai/dsh-tools@0.1.0-rc.7 可正常解析运行。 📦 安装 🚀 本插件已发布到 npm(dsh-vision-imagen),推荐直接安装: 方式一:npm 安装(推荐) npm i -g dsh-vision-imagen # 或 dsh plugin --profile web add dsh-vision-imagen 等价的一行安装: dsh plugin --profile web add dsh-vision-imagen 方式二:本地目录(开发/试用) git clone https://github.com/xuxun-oss/dsh-vision-imagen.git dsh plugin --profile web add /path/to/dsh-vision-imagen 然后重启 dsh web(或按 dsh 的插件热载提示操作) 安装后打开 设置 → Vision Imagen,填入 Google AI Studio 的 API Key,点「测试连接」即可。 💡 获取 Gemini API Key:(免费额度即可)。 🔌 多后端支持(不止 Gemini) 通过 provider 抽象层适配不同后端,同一个 DeepSeek 会话、无需切换模型: | 后端 | 视觉识别/自检 | 图像生成 | 兼容平台示例 | | --- | --- | --- | --- | | gemini(默认) | gemini-3.7-flash、gemini-3.6-flash、gemini-2.5-pro… | gemini-3.1-flash-lite-image(Nano Banana 2 Lite)、gemini-3.1-flash-image(Nano Banana 2)、gemini-3-pro-image(Nano Banana Pro)、imagen-4.0-generate-001 | Google AI Studio(免费 Key) | | openai(OpenAI 兼容) | gpt-4o、gpt-4o-mini、gpt-4.1、qwen-vl-max、qwen2.5-vl-72b、glm-4v-plus、glm-4v-flash、moonshot-v1-vision、minimax-vl、internvl、deepseek-vl2* | gpt-image-1、dall-e-3、flux-1.1-pro、flux-schnell、stable-diffusion、sd3.5-large、ideogram、recraft、hunyuan-image、seedream* | OpenAI / OpenRouter / 智谱 GLM / 阿里云百炼 Qwen / Moonshot Kimi / MiniMax / 硅基流动 SiliconFlow / 各类中转与自建网关 | \* 经 OpenAI 兼容端点/聚合平台提供。 设置页「后端 Provider」下拉切换;端点、模型列表、鉴权头(x-goog-api-key / Bearer)自动适配。换后端只需填对应的 API Key 与端点,工具调用方式完全不变——任何提供 OpenAI 兼容 /chat/completions(视觉)与 /images/generations、/images/edits(生图/编辑)的服务均可接入。 🎯 模型自动选择(auto) - 识别/自检:gemini-3.7-flash → gemini-3.6-flash → gemini-3.1-flash-lite → gemini-2.5-flash - 生图:gemini-3.1-flash-lite-image(Nano Banana 2 Lite)→ gemini-3.1-flash-image(Nano Banana 2)→ gemini-3-pro-image(Nano Banana Pro)→ gemini-2.5-flash-image → imagen-4.0-generate-001 设置页可下拉选择任意官方模型,或输入自定义模型名;模型不可用时自动沿链降级。 ⚙️ 说明 - 配置(含 API Key)保存在 ~/.dsh/vision-imagen.json。 - 生成后自动用 Gemini 视觉模型检查成品图并给出反馈(闭环,不依赖 modlens)。 - 图片保存在 ~/.dsh/vision-imagen-images/,工具结果卡片内联显示图片并提供可点击链接 /api/vision-imagen/images/。 - 仅走 原生 Gemini REST API(generateContent / predict),端点勿加 /openai。 ❓ FAQ Q: 为什么生成图后还要"自检"? A: 生成式模型偶尔会跑偏(缺手、多指、文字错误等)。插件每轮生成后都用视觉模型核对画面与你的要求是否一致,不达标自动按优化提示重绘,直到满意或达到轮数上限。 Q: 必须用 Gemini 吗? A: 不是。默认后端是 Gemini(免费 Key 即可),但通过 OpenAI 兼容后端可接入 GPT-4o、Qwen-VL、GLM-4V、gpt-image、DALL-E、Flux、Stable Diffusion 等几十种模型/平台。 Q: 我的 API Key 安全吗? A: Key 只保存在本机 ~/.dsh/vision-imagen.json,插件仅在调用后端 API 时使用,不会上传到任何第三方。设置页只回显 Key 的后 4 位。 Q: 图片保存在哪里? A: ~/.dsh/vision-imagen-images/,同时通过附件机制入库,可在会话中直接查看。 🔒 安全 - API Key 仅存本机,且设置页回显时脱敏(只显示后 4 位)。 - 插件的 HTTP 路由(/api/vision-imagen/*)只允许本机回环地址访问(非 loopback 请求返回 403)。 - 请勿把 ~/.dsh/vision-imagen.json 提交到任何版本库。 🤝 贡献 欢迎提 Issue 与 PR: - 报告 Bug / 建议新模型 → Issues - 修改代码 → Fork 后提交 PR,CI 会自动做语法检查 - 完善文档 → README 中英双语的修正同样欢迎 📄 目录 lib/index.js 宿主半:三个工具 + systemPrompt 引导 + 配置/模型 HTTP 路由 lib/client.js 浏览器半:设置页(settings.section) cordis.patch.yml 组合 patch(insert 行) package.json 包元数据(dsh.bundle / dsh.client) 📜 更新日志 见 CHANGELOG.md。 ⚖️ License MIT © Xun Xu (xuxun-oss)