dsh-image-gen 的五个入口分别解决什么问题
shanliuling/dsh-image-gen 的中文名是「AI 绘图工作室」,README 里把自己定义为「DeepSeek Harness 的原生 AI 图像创作套件」。重点在「套件」两个字:它不是往对话里塞一个生图命令就完事的小工具,而是把图像创作这件事拆成五个入口,每个入口负责一段路。站点给它的分类是「视觉能力」(另有 ocr 能力徽章),Star 454,综合分 67.3,周下载 2,665,许可 Apache-2.0。
这篇不罗列功能,只讲这五个入口在真实工作流里各自站哪个位置、怎么串成一条流水线,以及产物最后落到哪里。
安装按 README 原文:
pnpm dsh plugin --profile web add dsh-image-gen@latest
已把 dsh 装成全局命令时用 dsh plugin --profile web add dsh-image-gen@latest;GitHub 直装把包名换成 git+https://github.com/shanliuling/dsh-image-gen.git;本地源码则先 git clone 再指向目录。环境要求是 DeepSeek Harness 稳定版本加 Node.js ^22.19.0 或 >= 24.0.0。README 明确提了一句:本版本变化较大,老用户请更新至最新版本。
装之前先把两句话对齐
第一句:站点显示安装检查是「✓ 可直接安装」,依据是 npm 包 dsh-image-gen 已校验归属本仓库,属于静态结论。第二句:同一页面的实装验证是未通过(install_cmd_invalid),信任档位「需留意」,站点提示可能是验证环境差异,建议装前到 GitHub 仓库确认最近更新与 issue。
这两句不矛盾,但只看前一句容易误判。另外它需要可用凭据(自带 Key 或订阅登录)并且需要联网,没有凭据就完全走不动。
入口一:对话,先把想法说出来
对话入口解决的是「别等想清楚了再动手」。文生图、图生图、连续编辑、版本迭代都在这里,适合一边描述一边改,一句加一个约束地逼近想要的结果。
有一条上游差异必须提前知道,否则会白试:智谱 GLM-Image 上游本身不支持图生图;xAI Grok 的图生图走 OpenAI 兼容协议(multipart),部分网关可能需等待后续适配。所以如果你的主线是靠参考图改图,就选默认支持多图编辑的通道,例如 Gemini、OpenAI Images、Seedream、DashScope。
入口二:画布,草稿到成图的迭代
画布适合表达视觉创意:草稿生成、参考图组合、空间创作、持续修改。我的用法是把它当草稿纸——先把大致构图和元素位置摆出来,允许第一版很丑;布局定下来之后,再决定是回到对话里补细节,还是带着草稿去 Studio 做参数化重跑。
它和对话入口的区别不在能力,而在节奏:对话是线性的、一句话一步,画布是并行的、能同时比较几个版本。
入口三:工作台 Studio,管参数和批量
Studio 解决的是「同一套参数要跑很多组」:批量生成、多图参考、高级参数调整。它和其余入口的存储行为不同——候选图先留在临时画布,只有用户选中的结果才进入图库并保存。
这个设计的实际意义是:一次批量生成二十张,不会有二十张中间稿进你的图库,你只需要为选中的那几张决定去向。需要留意的是 Studio 目前只支持云端 Provider(含订阅通道),本地 ComfyUI 不在其中。
入口四:灵感,用来决定往哪个方向走
灵感入口是 Prompt 案例、风格探索与一键复用,解决的是「不知道要什么」,而不是「不知道怎么要」。它的配图按需加载并缓存在本机,浏览时不必每次都重新拉取,缓存也可以随时清理。看到合适的方向直接一键复用,再在对话或画布里改,比对着空白输入框硬想快得多。
入口五:图库,管生成结果的去向
图库负责搜索、收藏、下载和重新使用。这里有个必须记住的边界:图库元数据与收藏状态保存在当前浏览器的本地存储里,不是账号级同步。换台机器或换个浏览器,图库就是空的,所以重要成果别只留在图库里。
删除行为也值得说清楚:从图库删除记录不会修改原聊天消息;是否额外清理工作区里的本地图片文件是单独的勾选项,而文件删除通常无法恢复,动手前先确认勾了什么。
把五个入口串成一条实际流水线
我的串法是四步。第一步在灵感里找方向,一键复用拿到一个可用起点;第二步进对话快速试两三版,确认这条模型线能不能满足图生图需求;第三步如果构图复杂就转画布摆草稿;第四步方案定了再进 Studio,用批量生成和多图参考把同一套设定铺满尺寸、比例与风格变体。最后所有结果回图库筛选,选中的下载或落到工作区。
这套顺序的好处是每一步都可中断:方向不对回退到灵感,参数不对回退到画布。
工作区隔离存储:让产物跟着项目走
五个入口里,只有开启「保存到工作区」之后结果才真正落到磁盘:对话结果默认保存在当前工作区的 dsh-image-gen/ 子目录,也可以在设置中改到别处。配合 Studio「只保存选中结果」的行为,就得到一个很实用的性质——生成过程里的大量中间图不会污染工作区,只有确认过的产物才落盘。
所以批量创作时可以更放开:候选随便跑,选中才落地;图像产物和其他文件一样跟着项目目录走。
云端请求会把什么发出去
README 的「数据与隐私」写得很直白:云端请求会把 Prompt 与本次使用的参考图发送给所选 Provider。所以素材如果是公司内部界面、未公开的产品设计或者带个人信息的图,先别顺手拖进去。
要处理这类素材,选项是本地 ComfyUI(填写 DSH Host 可访问的服务地址,导入 API Format 的 Workflow JSON,可配多个命名工作流),或者先确认对应服务的条款。至于 Key 本身,它通过 DSH Credentials 服务保存,设置页不回显明文,订阅令牌也与 API Key 完全隔离、浏览器侧不接触,这部分不用自己操心。
另外,本地 ComfyUI 的请求只发送到你配置的地址,是这条取舍里唯一能绕开云端的一环。
总结
五个入口的分工可以一句话概括:灵感给方向、对话给速度、画布给空间、Studio 给规模和参数、图库给归档,而工作区隔离存储决定哪些产物真的留在你的项目里;想对照同类插件的中文清单与安装形态见 DeepSeek Harness Hub 插件清单。
适合与不适合
适合:已经在用 DSH、需要把「找方向 → 试稿 → 定稿 → 批量出图 → 归档」放进一条链路的创作者;经常用参考图改图、并且走默认支持多图编辑的云端通道的人;按项目隔离素材、希望生成产物自动落到当前工作区而不是散在下载目录的人;已经有 ChatGPT / Grok / Google 订阅、不想再单独配 API Key 的用户。
不适合:把「照着文档装就一定成」当验收标准的人——实装验证是未通过状态(install_cmd_invalid),信任档位只有「需留意」;既没有 API Key 也没有订阅账号的人——凭据是硬门槛,不填就完全不可用;素材敏感、不接受 Prompt 与参考图离开本机的人——云端通道会把这些发给 Provider,纯离线只剩本地 ComfyUI 一条路,而它在 Studio 与多模型对比上是缺口的。
标签:dsh-image-gen、DeepSeek Harness、AI 绘图工作室、工作流实践
本文由 DeepSeek Harness Hub 自动整理,数据来源于插件详情页。