DeepSeek Harness Hub
← 全部攻略

DeepSeek V4.1 Flash 发布:dsh 用户需要改什么(模型名 / 计费 / 成本)

2026/9/10 发布

2026 年 9 月 10 日,DeepSeek 正式发布 V4.1 Flash。对使用 DeepSeek Harness(dsh)的开发者来说,这次更新有三件事必须知道:API 模型名变了V4 Pro 要下线了Agent 场景成本降了

一、API 模型名改为 deepseek-flash

  • 新模型名:,deepseek-flash.replace(",", "")
  • 旧名 deepseek-v4-flashdeepseek-v4-flash-vision-exp 出于兼容考虑,暂时仍会路由到 V4.1 Flash
  • 建议:把 dsh 配置文件、脚本、环境变量里的模型名统一改成 deepseek-flash,不要依赖兼容路由——过渡期结束后旧名可能失效

二、9 月 14 日 12:00 起,V4 Pro 请求全部路由到 V4.1 Flash

  • 北京时间 2026-09-14 12:00 之后,至 V4.1 Pro 上线之前,访问 deepseek-v4-pro 的请求全部自动路由到 V4.1 Flash,并按 V4.1 Flash 单价计费
  • V4 Pro 模型将有序下线
  • 影响:如果你在 dsh 里硬编码了 v4-pro,服务不会中断,但计费口径变了(按更便宜的 Flash 计费);同时能力表现以 Flash 为准

三、Agent / Harness 场景成本显著下降

  • V4.1 Flash 是 552B 参数 MoE,采用全新的非对称结构:输入激活仅 8B、输出激活 16B,成本显著低于同尺寸模型
  • KV Cache 大幅压缩:HBM 需求降至上一代的 1/4,SSD 需求降至 1/8
  • 这一点对 dsh 这类 Agent 场景尤其关键——长上下文、多轮工具调用时缓存命中费用占比很高,缓存压缩直接降低单次任务成本
  • 官方数据:性能、费用、速度、总用时各项指标已全面超越 V4 Pro

四、dsh 用户操作清单

1. 改模型名:配置 / 脚本中的模型名改为 deepseek-flash

2. 检查是否用了 v4-pro:9/14 后会路由到 Flash,注意计费变化与能力差异

3. 批量任务排到闲时:仍采用峰谷定价,闲时价格为高峰时段的一半

4. 视觉 / 多模态任务:V4.1 Flash 原生支持视觉理解,不再需要单独切换视觉模型

五、一句话总结

V4.1 Flash 是 DeepSeek 把视觉能力从「外挂模型」升级为「原生能力」的关键版本,同时靠架构创新把 Agent 场景成本压了下来。对 dsh 用户而言,这是一次需要改配置、但长期更省钱的升级。

> 本文依据 DeepSeek 官方发布信息与公开报道整理,具体定价、路由规则与下线时间以 DeepSeek 官方公告为准。

订阅周报,不错过新攻略
每周一封 · 插件 + 福利

💬 加入 DPharness 群聊

插件用法、部署报错、新插件第一时间同步——群里问,比一个人翻文档快。

点击加入 QQ 群
DPharness 群聊二维码,手机 QQ 扫码进群
扫码进群