DeepSeek Harness Hub
← 返回列表

zhou1736948757-cpu/dsh-auto-continue

Cordisspec-screened在 GitHub 查看 ↗
未验证

回答被输出上限截断时自动续写——为自部署 Ollama 用户打造。

尚未跑自动兼容性验证,可查看页面内的依赖与入口分析。 · 最近上游提交 2026/8/25 · 已提供中文文档

Automatically resumes replies cut off at the output token limit — built for self-hosted Ollama users with small output caps. · 回答被输出上限截断时自动续写,面向自部署 Ollama 用户。

综合分
27.5
GitHub 分
27.5
用户评分
★ Stars
0
周下载量
安装插件(需先安装 dsh CLI 引擎:npm install -g @deepseek-ai/dsh)
dsh plugin --profile web add zhou1736948757-cpu/dsh-auto-continue
该插件未发布到 npm,走 GitHub 源安装(pnpm 若拦截 prepare 脚本,按其提示在 pnpm-workspace.yaml 的 allowBuilds 中放行后重跑)
数据截至 2026/9/18(元数据每日更新 · 实装验证按队列轮转,单条结论的验证时间见上方)
依赖的 DSH / Cordis 模块
@deepseek-ai/schemastery
用户评分
还没有人投票,来当第一个
订阅周报,不错过优质插件更新
每周一封 · 高评分插件 + 新用户活动

README

dsh-auto-continue

回答被输出上限截断时自动续写——为自部署 Ollama 用户打造。

dsh-plugin

当模型达到单次请求的输出 token 上限(max-tokens)时,DeepSeek Harness 会结束这一轮并提示"发送'继续'可让模型接着输出"。本插件监听该事件并自动发送续写指令——不用手动打字,不用守着长回答。

🦙 这个插件是给谁的? 自部署 Ollama 的用户。本地模型跑在消费级硬件上,通常刻意把输出上限设得很小(4K–8K)以保证硬件稳定——于是长回答频繁被截断。本插件就是让截断不再痛苦的"创可贴",不需要调高上限。任何 provider 都能用,但它是为 Ollama 设计的。

功能

- 🔁 自动续写:检测到 max-tokens 截断时,自动通过 agent.followup() 队列一条"继续",模型在新一轮接着输出。
- 🛡️ 防死循环:同一会话连续截断最多自动继续 5 次(默认),任何正常结束的轮次都会重置计数。
- 🙅 不抢输入:你已有排队消息时自动跳过,不与手动输入打架。
- 📝 审计日志:每次自动继续都有记录可查。

安装

dsh plugin --profile web add github:zhou1736948757-cpu/dsh-auto-continue

或在设置里的 dsh-market 插件市场中浏览安装。

工作原理

- 监听每个 agent 会话的 session/event 事件流,识别 turn/end 且 reason.kind === "max-tokens"。
- 短暂延迟(等 turn/end 落盘)后,通过 agent.followup() 队列一条用户消息(默认文本 继续,带 source.kind = "auto-continue" 标记)。
- 截断的输出保留在对话中,模型从断点接着输出——和你手动发"继续"完全一样,只是自动化了。

配置

在 settings.yaml 中添加(或直接用默认值):

dsh-auto-continue:
maxAutoContinues: 5      # 同一会话连续截断最多自动继续次数(1-20)
continueText: 继续        # 续写指令文本
delayMs: 300             # 检测到截断后延迟发送(ms),等 turn/end 落盘
logFile: ''              # 日志路径,默认 $DSH_HOME/super-injector/dsh-auto-continue.log

日志

每次自动继续都会写入 $DSH_HOME/super-injector/dsh-auto-continue.log(默认路径)。如果某次回答没续上,看日志就知道是"达到上限停止"还是"发送失败"。

说明

- 这是兜底方案,不是治本。如果硬件允许,调大模型 maxTokens(设置 → 模型)或降低 reasoningEffort 能减少截断本身。
- 推理强度为 max 时,截断可能发生在正文出现之前(额度被思考耗尽)。插件照常续写,模型会继续思考直到出正文。
- 每次续写就是一次普通请求,对硬件的压力与你手动发"继续"完全一样。

许可证

BSD-3-Clause

上游仓库有新提交时邮件通知你(每天最多一封,无更新不打扰),随时一键退订。

💬 加入 DPharness 群聊

插件用法、部署报错、新插件第一时间同步——群里问,比一个人翻文档快。

点击加入 QQ 群
DPharness 群聊二维码,手机 QQ 扫码进群
扫码进群