🎁 福利专区全网大模型免费应用 + 新用户福利 + 注册活动入口,低成本玩转 AI
广告☁️ 云服务器特惠阿里云首购 8 折 · 腾讯云合作特惠
DeepSeek Harness Hub
← 返回列表

3274375092/dsh-voice

DeepSeek 客户端兼容 / 相关生态spec-screened扫描:中风险在 GitHub 查看 ↗
⚠ 装前注意

dsh-voice 🎤

基本兼容但装前注意:未发布到 npm registry,仅可从源码安装 · 最近上游提交 2026/8/21 · 已提供中文文档

DeepSeek Harness 的语音输入插件:麦克风 → 本地/浏览器语音识别 → 文本作为普通聊天消息提交。仅输入,且与预设无关。

综合分
31.7
GitHub 分
31.7
用户评分
—
★ Stars
7
周下载量
—
兼容 / 相关生态插件(非 dsh 原生,请按其对应运行时安装)
git clone https://github.com/3274375092/dsh-voice.git
信任档位:仅索引本站尚未对其实装验证,仅收录元数据
是什么
生态插件(可安装,未声明 dsh 能力)
装得上吗
静态安装检查有提示项,装前建议看一眼 README
安全吗
本站尚未对该插件做风险分级(暂未覆盖,不等同于无风险)
还在维护吗
更新放缓:最近一次提交在 35 天前

档位由下列信号合成:本站实装验证(真实安装,当前最高到 L4)· 验证所用 dsh 版本 · 静态安装检查 · 风险分级 · 仓库维护状态。下方各区块是它的证据明细。 验证判据与等级说明 →

数据截至 2026/9/21(元数据每日更新 · 实装验证按队列轮转,单条结论的验证时间见上方)
安装兼容性检查⚠ 装前注意

以下结论由程序自动检查 npm 包、engines 声明与入口文件得出,未做人工实机验证——能装不等于用着没问题。

✗npm 包@nn12138/dsh-voice(未发布到 npm,仅可源码安装)
✓Node 引擎要求 ^22.19.0 || >=24.0.0 · 基线 Node 22.19 满足
✓dsh CLI 依赖未声明 dsh 版本约束
✓入口文件main/exports/bin 已声明

未发布到 npm registry,仅可从源码安装

验证方式:npm registry 存在性 + package.json 静态校验 · 最后验证 2026/9/21 23:35:37

依赖的 DSH / Cordis 模块
@deepseek-ai/schemastery@deepseek-ai/cordis
用户评分
还没有人投票,来当第一个
订阅周报,不错过优质插件更新
每周一封 · 高评分插件 + 新用户活动

README

由 DeepSeek 最新模型翻译生成
dsh-voice 🎤

DeepSeek Harness 的语音输入插件:网页里点 🎤(或按快捷键)说话,识别文本作为普通消息提交进会话。纯输入,与 agent preset/人设完全解耦,任何模式下都只是"另一种输入法"。

npm
License

特性

- 🎤 语音输入:麦克风按钮(平台设计系统 UI)+ 全局快捷键(默认 Ctrl+Space,可配)
- ⚡ 边说边识别:live-stream 部分识别实时回显,停麦 VAD 定稿提交(尾音补偿 0.6s,句尾不吞音)
- 🧠 双引擎自适应:host 原生(sherpa-onnx-node zipformer2 + silero VAD,离线、隐私)与浏览器在线(Web Speech,零依赖)自动探测降级
- 🔌 与 preset 解耦:不碰 persona/系统提示词,code/standard/minimal/自定义 preset 全通用
- 📦 可选模型:零配置开箱即用;想要原生一条 dsh-voice-models 下载

安装

插件本体
dsh plugin --profile web add @nn12138/dsh-voice

可选: 离线原生识别(插件本体零依赖,不自动装该运行时)
dsh plugin --profile web add sherpa-onnx-node
dsh-voice-models            # 一键下载模型(~100MB)→ ./dsh-voice-models

可选: 配置(编辑 ~/.dsh/profiles/web/cordis.patch.yml)

- id: voice
config:
modelDir: './dsh-voice-models'   # 原生识别模型目录
hotkey: 'ctrl+space'             # 全局快捷键
vadThreshold: 0.3                # 越低越不吞句首尾
tailPadSeconds: 0.6              # 尾音补偿时长
engine: auto                     # auto(默认) | native | browser

行内 config 由 host 半接收;engine / hotkey 会经 /voice.config loopback RPC 自动同步到浏览器半,无需另写 client 配置。auto 会先探测 host 原生能力:有模型用 native,无模型自动回退 Web Speech,保证零配置可用。修改配置后重启 dsh web。

dsh web   # 输入框左侧 🎤 或 Ctrl+Space

详见 USAGE.md 与 INSTALL.md。

工作原理

浏览器采麦(自动重采样 16k)
→ PCM base64 分块(256ms)→ /voice RPC 通道(loopback)
→ host: silero VAD + zipformer2 流式解码
→ partial 逐块回传(边说边看)/ final 定稿(VAD 分段 + 0.6s 尾音补偿)
→ conversation 服务提交(与打字同路)

双引擎:host 判定生效引擎(配置 + 模型加载结果),客户端经 /voice.ping 消费;原生不可用自动降级浏览器 Web Speech。

开发

pnpm install --ignore-workspace        # 独立依赖(不依赖 DSH monorepo;无安装期脚本)
pnpm --ignore-workspace test           # 单测(含真实模型冒烟)
pnpm --ignore-workspace typecheck      # 类型检查
pnpm --ignore-workspace build          # 构建(tsc host 半 + tsdown client 半)
pnpm --ignore-workspace verify:package # 发布包校验:无安装期脚本、产物完整、--ignore-scripts 可安装

构建只发生在发布方侧(prepack — npm pack/npm publish 时)与 CI 发布前;消费者从 registry 安装 @nn12138/dsh-voice 不会执行任何生命周期脚本,--ignore-scripts 安装依然完整可用(见 issue #2)。

真实模型烟测默认指向本机 voxelf assets,模型不存在时自动跳过;可用环境变量指到别处:
DSH_VOICE_MODEL_DIR(模型目录)/ DSH_VOICE_TEST_WAV(测试 wav)/ DSH_VOICE_DOWNLOADED_MODELS(下载模型目录)。

结构:src/index.ts(host 半)/ src/client/(浏览器半)/ src/core/(识别核心)/ tools/(线协议冒烟 + 模型下载)。

License

MIT

上游仓库有新提交时邮件通知你(每天最多一封,无更新不打扰),随时一键退订。

💬 加入社群

插件用法、部署报错、新插件第一时间同步——群里问,比一个人翻文档快。

DPharness QQ 群二维码,QQ 扫码进群
QQ 扫码进群
DPharness 飞书群二维码,飞书扫码进群
飞书扫码进群