🎁 福利专区全网大模型免费应用 + 新用户福利 + 注册活动入口,低成本玩转 AI
广告☁️ 云服务器特惠阿里云首购 8 折 · 腾讯云合作特惠
DeepSeek Harness Hub
← 返回列表

wumohan1814/dsh-architect-flash

DeepSeek Harnessspec-screened扫描:无法判定在 GitHub 查看 ↗
未验证

Architect-Flash · 架构师模式Pro+Flash

尚未跑自动兼容性验证,可查看页面内的依赖与入口分析。 · 最近上游提交 2026/9/11 · 已提供中文文档

DeepSeek Harness 的 Pro/Flash 双层编码预设——主架构师负责规划与审查,code_flash 子代理在廉价的 Flash 模型上实现底层代码。

综合分
28.6
GitHub 分
28.6
用户评分
—
★ Stars
0
周下载量
—
安装插件(需先安装 dsh CLI 引擎:npm install -g @deepseek-ai/dsh)
dsh plugin --profile web add wumohan1814/dsh-architect-flash
该插件未发布到 npm,走 GitHub 源安装(pnpm 若拦截 prepare 脚本,按其提示在 pnpm-workspace.yaml 的 allowBuilds 中放行后重跑)
信任档位:已验证本站已于 0 天前真实安装成功
是什么
dsh 原生插件 · chat
装得上吗
本站已真实安装成功(非静态推断)
安全吗
本站尚未对该插件做风险分级(暂未覆盖,不等同于无风险)
还在维护吗
活跃:最近一次提交在 14 天前

档位由下列信号合成:本站实装验证(真实安装,当前最高到 L4)· 验证所用 dsh 版本 · 静态安装检查 · 风险分级 · 仓库维护状态。下方各区块是它的证据明细。 验证判据与等级说明 →

🟢实装验证通过· 2026/9/25
由本站实装验证器在真实 dsh 环境安装成功,非静态推断。
数据截至 2026/9/24(元数据每日更新 · 实装验证按队列轮转,单条结论的验证时间见上方)
用户评分
还没有人投票,来当第一个
订阅周报,不错过优质插件更新
每周一封 · 高评分插件 + 新用户活动

README

由 DeepSeek 最新模型翻译生成
Architect-Flash · 架构师模式(Pro+Flash)

License: MIT
DeepSeek Harness

削减你的编码 token 账单。 一个 DeepSeek Harness 智能体预设,在你的主模型上进行规划与
审查,并将所有底层代码实现交给廉价的 Flash 子智能体——因此昂贵的模型永远不写代码。

英文

为什么选择 Architect-Flash

- 💸 节省 token 和成本——代码实现是任何编码任务中 token 消耗最大的部分;在这里,它运行在廉价的 Flash 子模型上,而不是你的主模型上。
- 🧠 清晰的关注点分离——一位架构师负责规划、设计和审查;一位工作者负责实现。职责不再模糊。
- 🔒 隔离的上下文——工作者在自己的上下文中编辑文件,使架构师的上下文保持精简且对缓存友好。
- 🔌 无硬编码模型——工作者遵循你在子智能体设置中选择的子模型,因此该预设可跨部署移植。
- 🧰 完整的原生工具链——标准的编码工具目录,外加一个可直接调用的 code_flash 委派工具。

架构

┌────────────────────────────────────────────────────────────┐
│  Architect  (main model, e.g. deepseek-v4-pro)            │
│  plan · design · review · git · verify builds             │
└────────────────────────────┬───────────────────────────────┘
│  delegate to code_flash
▼
┌────────────────────────────────────────────────────────────┐
│  code_flash worker  (selected sub-model, e.g. Flash)      │
│  read · write · edit · glob · grep · pwsh · todo_write    │
│  isolated context · maxDepth 1 (no recursion)             │
└────────────────────────────────────────────────────────────┘

对比

| | standard | ptc(PTC 模式) | architect-flash |
| --- | --- | --- | --- |
| 工具呈现 | 原生 | 单一 run_code | 原生 |
| 模型分层 | 单一模型 | 单一模型 | Pro(主)+ Flash(工作者) |
| 谁编写代码 | 模型自身 | 模型自身(在 run_code 中) | Flash 工作者 |
| 委派工具 | subagent | 隐藏在 run_code SDK 之后 | code_flash,直接调用 |
| Token 成本 | 单一模型全价 | 单一模型全价 | 代码运行在更便宜的模型上 |
| 缓存/schema | 中等 | 最佳(极小的 schema) | 中等(但模型更便宜) |

PTC 模式优化 schema 和往返次数;Architect-Flash 优化的是由哪个模型承担繁重工作。如果你的代码实现主导了 token 支出,那么 Flash 拆分通常比 PTC 的 schema 节省更多。

快速开始

Linux / macOS
cp -r architect-flash "$HOME/.dsh/.agent-presets/architect-flash"

Windows (PowerShell)
Copy-Item -Recurse architect-flash "$env:USERPROFILE\.dsh\.agent-presets\architect-flash"
重启主机,启动新会话,然后选择 Architect-Flash(架构师模式)。

要求

- 带有 dsh-agent-tool-presentation 架构的 DeepSeek Harness
(native / ptc / both),以及带有
modelSelectionSettings 的 @deepseek-ai/dsh-tool-subagent。
- 在会话的
subagent-model-selection.allowedModels 策略下注册一个支持 Flash 的 LLM 路由。code_flash 不硬编码任何
路由——它跟随子代理所选的子模型。

选择子模型

子模型是会话级设置,而不是预设旋钮。在
settings.yaml 中的 subagent-model-selection.allowedModels 下注册
code_flash 工作器可以使用的路由:

subagent-model-selection:
enabled: true
allowedModels:
- provider: ark
model: deepseek-v4-flash

code_flash 使用 modelSelectionSettings: true 来遵循此策略。架构师
通过 list_subagent_models 发现子模型,并传入其
provider/model,因此子模型就是子代理设置所选择的那个。

行为契约

该角色编码了两条规则:

1. 对于代码实现——尤其是重复性或底层代码——
委托给所选子模型上的 code_flash 工作器,而不是
内联编写。
2. 当被委托的工作器正在运行时,不要用目标更新进行轮询;停下来
等待其结果被注入。

这些是行为层面的(角色),而不是物理层面的。要让“编写代码”成为单一
物理路径,可以从主代理的工具中移除 write/edit——但
架构师仍然需要它们来编写文档(需求/缺陷表),因此
代码与文档的边界最好保留为工作区指令。

常见问题

为什么用 native 而不是 PTC? PTC 将所有工具折叠为一个 run_code 工具,
并把委托工具隐藏在其 SDK 之后——在那里不可能存在一个独立的、可直接调用的
code_flash。Native 让 code_flash 保持为一等公民。

我应该选哪个子模型? 你的提供商提供的任何更便宜的、具备推理能力的模型
(例如 deepseek-v4-flash)。将其注册到
subagent-model-selection.allowedModels 下。

如何强制所有代码都交给工作器? 从
主代理的目录中移除 write/edit。这样文档编辑也会经过工作器,因此
请决定你是否想要那样。

它在 Windows 上能用吗? 能。在 Windows 上 shell 工具是 pwsh;在其他
平台上则是 bash。code_flash 工具过滤器会指定正确的那个。

文件

| 文件 | 用途 |
| --- | --- |
| agent.cordis.yml | 代理平面组合(角色、工具、委托)。 |
| preset.yml | 显示元数据(name、description)。 |
| NOTICE | 衍生 standard 预设的署名。 |
| LICENSE | MIT。 |

中文

为什么用 Architect-Flash

- 💸 省 token、省成本 —— 代码实现是编码任务里 token 最重的部分,这里它跑在便宜的
Flash 子模型上,而不是主模型上。
- 🧠 职责清晰 —— 一个架构师负责规划/设计/审查,一个工人负责实现,互不混淆。
- 🔒 上下文隔离 —— 工人在自己的上下文里改文件,架构师的上下文保持精简、利于缓存。
- 🔌 不硬编码模型 —— 工人跟随你在 sub-agent 设置里选择的子模型,preset 跨部署可移植。
- 🧰 完整原生工具 —— 标准编码目录 + 可直接调用的 code_flash 委派工具。

架构

┌────────────────────────────────────────────────────────────┐
│  架构师  (主模型,如 deepseek-v4-pro)                    │
│  规划 · 设计 · 审查 · git · 验证构建                       │
└────────────────────────────┬───────────────────────────────┘
│  委派给 code_flash
▼
┌────────────────────────────────────────────────────────────┐
│  code_flash 工人  (所选子模型,如 Flash)                 │
│  read · write · edit · glob · grep · pwsh · todo_write     │
│  独立上下文 · maxDepth 1(禁止递归)                       │
└────────────────────────────────────────────────────────────┘

对比

| | standard | ptc(PTC 模式) | architect-flash |
| --- | --- | --- | --- |
| 工具呈现 | 原生 | 单一 run_code | 原生 |
| 模型分级 | 单模型 | 单模型 | Pro(主)+ Flash(工人) |
| 谁写代码 | 模型自己 | 模型自己(在 run_code 里) | Flash 工人 |
| 委派工具 | subagent | 藏在 run_code SDK 后 | code_flash,直接调用 |
| token 成本 | 单模型全价 | 单模型全价 | 代码跑在便宜模型上 |
| 缓存/schema | 中 | 最优(极小 schema) | 中(但模型更便宜) |

PTC 优化的是 schema 和往返;Architect-Flash 优化的是哪个模型干重活。当代码实现占大头
时,Flash 分级通常比 PTC 省得更多。

快速开始

Linux / macOS
cp -r architect-flash "$HOME/.dsh/.agent-presets/architect-flash"

Windows (PowerShell)
Copy-Item -Recurse architect-flash "$env:USERPROFILE\.dsh\.agent-presets\architect-flash"

重启宿主,新建会话,选择 Architect-Flash(架构师模式)。

依赖

- 具备 dsh-agent-tool-presentation(native/ptc/both)架构、以及支持
modelSelectionSettings 的 @deepseek-ai/dsh-tool-subagent 的 DeepSeek Harness。
- 一条在会话 subagent-model-selection.allowedModels 策略下注册、能承载 Flash 的
LLM 路由。code_flash 不硬编码任何路由 —— 它跟随 sub-agent 选择的子模型。

选择子模型

子模型是会话级设置,不是 preset 的开关。在 settings.yaml 的
subagent-model-selection.allowedModels 下注册 code_flash 可用的路由:

subagent-model-selection:
enabled: true
allowedModels:
- provider: ark
model: deepseek-v4-flash

code_flash 用 modelSelectionSettings: true 遵循该策略。架构师通过
list_subagent_models 发现子模型并传入其 provider/model,因此子模型就是 sub-agent
设置里选中的那一个。

行为契约

persona 编码了两条规则:

1. 代码实现 —— 尤其是重复性或底层代码 —— 委派给所选子模型上的 code_flash,不要
内联编写。
2. 子代理运行时,不要用 goal 轮询;停下并等待其结果注入。

这是行为约束(靠 persona),不是物理约束。要让"写代码"成为唯一物理路径,可把主 Agent
的 write/edit 摘掉 —— 但注意架构师维护文档仍需要它们,所以"代码 vs 文档"的边界
最好放在工作区指令里。

FAQ

为什么用原生而不是 PTC? PTC 把所有工具折叠成一个 run_code,委派工具藏在其 SDK
后面 —— 那里无法存在可直接调用的 code_flash。原生让 code_flash 保持一等工具。

该选哪个子模型? 你的 provider 提供的任意更便宜的推理模型(例如
deepseek-v4-flash),把它注册进 subagent-model-selection.allowedModels 即可。

怎么强制所有代码都进工人? 把主 Agent 目录里的 write/edit 摘掉。那样文档编辑
也得走工人,想清楚是否需要。

Windows 能用吗? 能。Windows 上 shell 工具是 pwsh,其它平台是 bash;code_flash
的工具过滤会点名正确的那一个。

文件

| 文件 | 用途 |
| --- | --- |
| agent.cordis.yml | agent-plane 组合(persona、工具、委派)。 |
| preset.yml | 展示元数据(name、description)。 |
| NOTICE | 对派生来源 standard 预设的归属声明。 |
| LICENSE | MIT。 |

上游仓库有新提交时邮件通知你(每天最多一封,无更新不打扰),随时一键退订。

同作者(wumohan1814)的其他插件

💬 加入社群

插件用法、部署报错、新插件第一时间同步——群里问,比一个人翻文档快。

DPharness QQ 群二维码,QQ 扫码进群
QQ 扫码进群
DPharness 飞书群二维码,飞书扫码进群
飞书扫码进群