DeepSeek Harness Hub
← 返回列表

bigfurma-bot/dsh-voice-dictation

DeepSeek Harnessspec-screened在 GitHub 查看 ↗
未验证

为 DeepSeek Harness DSH 提供的按键说话语音听写功能:

尚未跑自动兼容性验证,可查看页面内的依赖与入口分析。 · 最近上游提交 2026/8/22 · 已提供中文文档

DeepSeek Harness 的按键说话语音听写:输入框中的麦克风按钮通过本地 Parakeet STT 将语音转写为你的消息草稿

综合分
27.2
GitHub 分
27.2
用户评分
★ Stars
0
周下载量
安装插件(需先安装 dsh CLI 引擎:npm install -g @deepseek-ai/dsh)
dsh plugin --profile web add bigfurma-bot/dsh-voice-dictation
该插件未发布到 npm,走 GitHub 源安装(pnpm 若拦截 prepare 脚本,按其提示在 pnpm-workspace.yaml 的 allowBuilds 中放行后重跑)
数据截至 2026/9/18(元数据每日更新 · 实装验证按队列轮转,单条结论的验证时间见上方)
用户评分
还没有人投票,来当第一个
订阅周报,不错过优质插件更新
每周一封 · 高评分插件 + 新用户活动

README

dsh-voice-dictation

为 DeepSeek Harness (DSH) 提供的按键说话语音听写功能:
消息编辑器中的麦克风按钮会录制你的声音,通过本地语音转文字服务器进行转录,
并将文本直接填入消息草稿——实现免手动提示。

工作原理

- 浏览器端 —— 编辑器中的麦克风按钮;按住/点击进行录制,松开后音频
发送到主机端。
- 主机端 —— POST /voice/transcribe 将音频转发到本地
Parakeet STT HTTP 服务器(默认
http://127.0.0.1:5093),当服务不可达时以本地 whisper CLI 作为回退。
- 转录后的文本会填入编辑器草稿;由你审阅并发送。

一切都在你的机器上运行——不使用云端语音 API。

| 编辑器中的麦克风按钮 | 听写中…… | 文本填入草稿 |
|---|---|---|
| 编辑器中的麦克风按钮 | 听写中 | 草稿已填入 |

安装

cd ~/.dsh/profiles/web
rm -rf node_modules/@deepseek-ai/dsh-voice-dictation   # 删除任何过期的副本
pnpm add --force "file:/path/to/this/repo"

将组合行添加到 ~/.dsh/profiles/web/cordis.patch.yml:

- insert:
- id: voice-dictation
name: '@deepseek-ai/dsh-voice-dictation'

重启 DSH web,然后在编辑器中寻找麦克风按钮。

配置

| 键 | 默认值 | 含义 |
|---|---|---|
| sttUrl | http://127.0.0.1:5093 | 兼容 Parakeet 的 STT HTTP 端点 |
| sttModel | 服务器默认值 | 传递给 STT 服务器的模型选择器 |

你需要一个正在运行的 STT 后端,例如在配置端口上通过 HTTP 提供服务的 NVIDIA Parakeet。
如果没有,插件会降级为 whisper CLI 回退方案(需要 whisper 位于 PATH 中)。

许可证

MIT —— 参见 LICENSE。

上游仓库有新提交时邮件通知你(每天最多一封,无更新不打扰),随时一键退订。

同作者(bigfurma-bot)的其他插件

💬 加入 DPharness 群聊

插件用法、部署报错、新插件第一时间同步——群里问,比一个人翻文档快。

点击加入 QQ 群
DPharness 群聊二维码,手机 QQ 扫码进群
扫码进群