🎁 福利专区全网大模型免费应用 + 新用户福利 + 注册活动入口,低成本玩转 AI
广告☁️ 云服务器特惠阿里云首购 8 折 · 腾讯云合作特惠
DeepSeek Harness Hub
← 返回列表

difimim/dsh-voice-input-npm

DeepSeek Harnessspec-screened扫描:低风险在 GitHub 查看 ↗
未验证

语音输入插件 for Deepseek Harness

尚未跑自动兼容性验证,可查看页面内的依赖与入口分析。 · 最近上游提交 2026/8/30 · 已提供中文文档
综合分
28.7
GitHub 分
28.7
用户评分
—
★ Stars
1
周下载量
—
安装插件(需先安装 dsh CLI 引擎:npm install -g @deepseek-ai/dsh)
dsh plugin --profile web add difimim/dsh-voice-input-npm
该插件未发布到 npm,走 GitHub 源安装(pnpm 若拦截 prepare 脚本,按其提示在 pnpm-workspace.yaml 的 allowBuilds 中放行后重跑)
信任档位:已验证本站已于 0 天前真实安装成功
是什么
dsh 原生插件 · other
装得上吗
本站已真实安装成功(非静态推断)
安全吗
本站尚未对该插件做风险分级(暂未覆盖,不等同于无风险)
还在维护吗
活跃:最近一次提交在 26 天前

档位由下列信号合成:本站实装验证(真实安装,当前最高到 L4)· 验证所用 dsh 版本 · 静态安装检查 · 风险分级 · 仓库维护状态。下方各区块是它的证据明细。 验证判据与等级说明 →

🟢实装验证通过· 2026/9/25
由本站实装验证器在真实 dsh 环境安装成功,非静态推断。
数据截至 2026/9/19(元数据每日更新 · 实装验证按队列轮转,单条结论的验证时间见上方)
依赖的 DSH / Cordis 模块
@deepseek-ai/cordis@deepseek-ai/dsh-client-runtime@deepseek-ai/dsh-client-ui-conversation
用户评分
还没有人投票,来当第一个
订阅周报,不错过优质插件更新
每周一封 · 高评分插件 + 新用户活动

README

由 DeepSeek 最新模型翻译生成
DSH 语音输入 · DeepSeek Harness 语音输入插件

在 DeepSeek Harness(DSH)输入框底部加入一个麦克风按钮:点击后用浏览器内置的 Web Speech API 把语音实时转成文字并填入输入框。零成本、零服务端部署。

A DeepSeek Harness plugin that adds a microphone button to the composer. Click it to transcribe speech into the input box using the browser's built-in Web Speech API — zero cost, zero server.

安装

这是一个标准的 DSH 插件 bundle,用一条命令安装:

dsh plugin --profile web add @difimim/dsh-voice-input

装完重启 DSH(dsh web),按钮就会出现在输入框工具行左侧。

其他 profile(如 tui)同理:dsh plugin --profile tui add @difimim/dsh-voice-input。

从本地 / 未发布源码安装

还没发布到 npm 时,可以按路径安装:

dsh plugin --profile web add file:/path/to/dsh-voice-input
或
dsh plugin --profile web add link:/path/to/dsh-voice-input

功能特性

- 🎙️ 输入框工具行左侧新增麦克风按钮,点击开始 / 停止收音
- ⚡ 实时识别:边说边把中间结果写进输入框草稿
- ➕ 追加式写入:不清空已有文字,识别结果追加到当前草稿末尾
- 🌐 零成本零服务端:直接复用浏览器内置 Web Speech API
- 🎨 跟随主题:按钮颜色使用 DSH 主题变量,自动适配明暗色

使用

1. 点麦克风图标 → 按钮变红并出现脉冲动画,开始收音;
2. 直接说话,文字会实时出现在输入框里;
3. 再点一下(图标变方块)→ 停止收音;
4. 确认文字无误后,正常回车发送。

工作原理

| 部分 | 说明 |
| --- | --- |
| 识别引擎 | 浏览器内置 Web Speech API(SpeechRecognition / webkitSpeechRecognition) |
| 识别语言 | 默认 zh-CN(中文),可在 lib/client.js 里改 rec.lang |
| 写入方式 | 通过输入框 Slot 提供的 inputActions.setDraft() 写入草稿,与手打内容共存 |
| 按钮位置 | conversation.input.left(输入框工具行左侧,模型选择那一行) |

浏览器兼容性

| 浏览器 | 支持 |
| --- | --- |
| Chrome / Edge | ✅(推荐) |
| Safari | ✅(较新版本,行为略有差异) |
| Firefox | ❌(不支持 Web Speech API) |

- 首次点击会弹出麦克风授权,请点「允许」。
- 需联网:Web Speech API 会把音频交给浏览器厂商的识别服务器。

隐私说明

当前方案(Web Speech API)为了“零成本、零部署”,会把语音发到浏览器厂商的识别服务。若你在意隐私或需要完全离线,请参考下方 Roadmap 的 Vosk 接入计划。

目录结构

dsh-voice-input/
├── package.json      # dsh.client + dsh.bundle.patch 声明
├── cordis.patch.yml  # bundle patch:把本插件挂进 host 组合
├── lib/
│   ├── index.js      # Node 半(纯 UI 插件,空 apply)
│   └── client.js     # 浏览器半(麦克风按钮 + Web Speech 识别)
├── README.md
└── LICENSE

Roadmap

- [x] Web Speech API 实时语音输入
- [ ] 语言切换(中文 / 英文 / 自动)
- [ ] Vosk 离线识别接入(通过 host 侧 Remote 服务)
- [ ] 语音输入过程中的可视化状态条

License

MIT

上游仓库有新提交时邮件通知你(每天最多一封,无更新不打扰),随时一键退订。

同作者(difimim)的其他插件

💬 加入社群

插件用法、部署报错、新插件第一时间同步——群里问,比一个人翻文档快。

DPharness QQ 群二维码,QQ 扫码进群
QQ 扫码进群
DPharness 飞书群二维码,飞书扫码进群
飞书扫码进群