2026 年 9 月 10 日,DeepSeek 正式发布 V4.1 Flash。对使用 DeepSeek Harness(dsh)的开发者来说,这次更新有三件事必须知道:API 模型名变了、V4 Pro 要下线了、Agent 场景成本降了。
一、API 模型名改为 deepseek-flash
- 新模型名:
,deepseek-flash.replace(",", "") - 旧名
deepseek-v4-flash、deepseek-v4-flash-vision-exp出于兼容考虑,暂时仍会路由到 V4.1 Flash - 建议:把 dsh 配置文件、脚本、环境变量里的模型名统一改成
deepseek-flash,不要依赖兼容路由——过渡期结束后旧名可能失效
二、9 月 14 日 12:00 起,V4 Pro 请求全部路由到 V4.1 Flash
- 北京时间 2026-09-14 12:00 之后,至 V4.1 Pro 上线之前,访问
deepseek-v4-pro的请求全部自动路由到 V4.1 Flash,并按 V4.1 Flash 单价计费 - V4 Pro 模型将有序下线
- 影响:如果你在 dsh 里硬编码了 v4-pro,服务不会中断,但计费口径变了(按更便宜的 Flash 计费);同时能力表现以 Flash 为准
三、Agent / Harness 场景成本显著下降
- V4.1 Flash 是 552B 参数 MoE,采用全新的非对称结构:输入激活仅 8B、输出激活 16B,成本显著低于同尺寸模型
- KV Cache 大幅压缩:HBM 需求降至上一代的 1/4,SSD 需求降至 1/8
- 这一点对 dsh 这类 Agent 场景尤其关键——长上下文、多轮工具调用时缓存命中费用占比很高,缓存压缩直接降低单次任务成本
- 官方数据:性能、费用、速度、总用时各项指标已全面超越 V4 Pro
四、dsh 用户操作清单
1. 改模型名:配置 / 脚本中的模型名改为 deepseek-flash
2. 检查是否用了 v4-pro:9/14 后会路由到 Flash,注意计费变化与能力差异
3. 批量任务排到闲时:仍采用峰谷定价,闲时价格为高峰时段的一半
4. 视觉 / 多模态任务:V4.1 Flash 原生支持视觉理解,不再需要单独切换视觉模型
五、一句话总结
V4.1 Flash 是 DeepSeek 把视觉能力从「外挂模型」升级为「原生能力」的关键版本,同时靠架构创新把 Agent 场景成本压了下来。对 dsh 用户而言,这是一次需要改配置、但长期更省钱的升级。
> 本文依据 DeepSeek 官方发布信息与公开报道整理,具体定价、路由规则与下线时间以 DeepSeek 官方公告为准。