← 返回列表
⚠ 装前注意
给 DSH 文本模型装眼睛:图片自动调用 mmxMiniMax VLM识别,识别结果注入模型上下文
基本兼容但装前注意:未发布到 npm registry,仅可从源码安装 · 最近上游提交 2026/8/31 · 已提供中文文档
给 DSH 文本模型装眼睛:图片自动调用 mmx(MiniMax VLM)识别,识别结果注入模型上下文
综合分
33.7
GitHub 分
33.7
用户评分
—
★ Stars
1
周下载量
—
兼容 / 相关生态插件(非 dsh 原生,请按其对应运行时安装)
git clone https://github.com/fengs2021/dsh-image-mmx.git信任档位:已验证本站已于 4 天前真实安装成功(L4 · 真实安装)
- 是什么
- 生态插件(可安装,未声明 dsh 能力)
- 装得上吗
- 本站已真实安装成功(L4 · 真实安装,非静态推断)
- 安全吗
- 本站尚未对该插件做风险分级(暂未覆盖,不等同于无风险)
- 还在维护吗
- 活跃:最近一次提交在 25 天前
档位由下列信号合成:本站实装验证(真实安装,当前最高到 L4)· 验证所用 dsh 版本 · 静态安装检查 · 风险分级 · 仓库维护状态。下方各区块是它的证据明细。 验证判据与等级说明 →
🟢实装验证通过· 2026/9/22
由本站实装验证器在真实 dsh 环境安装成功,非静态推断。
数据截至 2026/9/20(元数据每日更新 · 实装验证按队列轮转,单条结论的验证时间见上方)
安装兼容性检查⚠ 装前注意
以下结论由程序自动检查 npm 包、engines 声明与入口文件得出,未做人工实机验证——能装不等于用着没问题。
✗npm 包dsh-image-mmx(未发布到 npm,仅可源码安装)
✓Node 引擎要求 >=18 · 基线 Node 22.19 满足
✓dsh CLI 依赖未声明 dsh 版本约束
✓入口文件main/exports/bin 已声明
未发布到 npm registry,仅可从源码安装
验证方式:npm registry 存在性 + package.json 静态校验 · 最后验证 2026/9/20 11:27:48
依赖的 DSH / Cordis 模块
@deepseek-ai/cordis用户评分
还没有人投票,来当第一个
订阅周报,不错过优质插件更新
每周一封 · 高评分插件 + 新用户活动
README
由 DeepSeek 最新模型翻译生成dsh-image-mmx 为 DeepSeek Harness 的文本模型装上一双眼睛:在会话中粘贴/发送图片,自动调用 mmx(MiniMax VLM) 进行识别,识别结果注入模型上下文——DeepSeek 等纯文本模型也能理解图片内容。 能力 - 图片收发:文本模型(inputModalities 不含 image)也能发送含图消息,不再报「当前模型不支持图片」 - 自动识别:图片落盘到会话工作区 .attachments/,自动执行 mmx vision describe(MiniMax VLM) - 模型可见替换:图片块在模型可见面替换为 [图片N]:"" + mmx 识别文本(画面元素、布局、报错/代码/界面文字逐字保留) - 用户侧不变:人类 transcript 照常渲染原图缩略图(可点击放大) - 优雅降级:mmx 未安装/未认证/超时(60s)/格式不支持(gif)时降级为路径文本 - 原生模型免打扰:本身支持图片输入的模型走原生路径,不做任何处理 配套插件:dsh-file-bridge(📎 附件按钮上传 + send_files 文件下发 + explorer 跳转)。 依赖 本机已安装并认证 mmx-cli(MiniMax 官方 CLI): npm install -g mmx-cli mmx auth login --api-key sk-xxxxx # 或 OAuth mmx vision describe --image test.png # 验证可用 安装 前置:DeepSeek Harness 0.1.0-rc.6+、Node.js 18+。 dsh plugin --profile web add 'github:fengs2021/dsh-image-mmx' systemctl restart dsh-web 使用 1. 在 DSH Web 输入框粘贴/拖入图片(或配合 dsh-file-bridge 的 📎 附件按钮选图) 2. 发送后插件自动:落盘 → mmx 识别 → 模型直接读到识别结果并回复 3. 多图支持:每张图独立并行识别,按 [图片1] [图片2]... 编号 实现 基于 dsh-image-bridge(MIT)机制改造: 1. 包装 llm.resolveModelInfo 为文本模型补 image 模态(放行 api-proxy 预检) 2. agent/pre-step:图片落盘 + 并行调用 mmx vision describe 3. agent/request-error:surface replace 把图片块换成识别文本,retry 重发 License MIT