← 返回列表
✓ 可直接安装
二重奏:DSH 语音操控和语音播报
自动检查通过:npm 包已发布且 engines 声明满足基线(声明 Node ^22.19.0 || >=24.0.0);该结论来自程序自动检查,未经人工实机验证。 · 最近上游提交 2026/9/23 · 已提供中文文档
综合分
33.6
GitHub 分
33.6
用户评分
—
★ Stars
5
周下载量
—
安装插件(需先安装 dsh CLI 引擎:npm install -g @deepseek-ai/dsh)
dsh plugin --profile web add dsh-duetnpm 包 dsh-duet 已校验归属本仓库,走 npm 安装最省事
信任档位:已验证本站已于 3 天前真实安装成功(L4 · 真实安装)
- 是什么
- dsh 原生插件 · other
- 装得上吗
- 本站已真实安装成功(L4 · 真实安装,非静态推断)
- 安全吗
- 本站尚未对该插件做风险分级(暂未覆盖,不等同于无风险)
- 还在维护吗
- 活跃:最近一次提交在 2 天前
档位由下列信号合成:本站实装验证(真实安装,当前最高到 L4)· 验证所用 dsh 版本 · 静态安装检查 · 风险分级 · 仓库维护状态。下方各区块是它的证据明细。 验证判据与等级说明 →
🟢实装验证通过· 2026/9/22
由本站实装验证器在真实 dsh 环境安装成功,非静态推断。
数据截至 2026/9/24(元数据每日更新 · 实装验证按队列轮转,单条结论的验证时间见上方)
安装兼容性检查✓ 自动检查通过
以下结论由程序自动检查 npm 包、engines 声明与入口文件得出,未做人工实机验证——能装不等于用着没问题。
✓npm 包dsh-duet @ 0.1.3
✓Node 引擎要求 ^22.19.0 || >=24.0.0 · 基线 Node 22.19 满足
✓dsh CLI 依赖未声明 dsh 版本约束
✓入口文件main/exports/bin 已声明
验证方式:npm registry 存在性 + package.json 静态校验 · 最后验证 2026/9/22 11:29:20
用户评分
还没有人投票,来当第一个
订阅周报,不错过优质插件更新
每周一封 · 高评分插件 + 新用户活动
README
由 DeepSeek 最新模型翻译生成duet. DSH 语音操控和语音播报 https://github.com/user-attachments/assets/83152138-c292-4057-a820-efc2bc96f33a duet,意为「二重奏」。这里的 duet 使用全双工语音模型,可以边听边说, 让你与 DSH 的交流不必一人一句地等待。 说出需求、修改输入、发送任务、切换会话——把键盘上的操作交给声音。你可以随时插话、补充或纠正。处理任务之外,也可以聊聊天。 当然,你也可以用 duet 帮你只播报结果,让你不用一直盯着屏幕。 最重要的是,duet 语音服务目前可以免费使用。 安装 已验证兼容 DSH 0.1.5-rc.2 和 0.1.6-alpha.2。 安装并打开 DeepSeek Harness: npm install -g @deepseek-ai/dsh dsh web 在另一个终端为 Web profile 安装插件,再重启 DSH: dsh plugin --profile web add dsh-duet dsh web 也支持 DSH 的 GitHub 插件安装方式:dsh plugin --profile web add github:YuMS/dsh-duet。 两种方式任选其一。 使用 duet 支持两种模式。 | 按钮 | 模式 | 用途 | | --- | --- | --- | | 喇叭 | 播报模式 | 任务完成后,进行简短的播报 | | 双向箭头 | 交互模式 | 开口操作 DSH、自由聊天,也可以在回复过程中插话 | 目前支持的语音操作 | 操作 | 你可以这样说 | | --- | --- | | 输入内容 | “输入,帮我整理一下这周的计划” | | 修改内容 | “把这周改成下周” | | 清空输入框 | “清空输入框” | | 发送任务 | “发送”“提交” | | 新建会话 | “新建一个会话,叫旅行计划” | | 切换会话 | “切换到第二个会话”“切换到旅行计划” | | 重命名会话 | “把当前会话改名为周末安排” | | 分叉会话 | “从当前会话分叉一个新会话” | | 归档会话 | “归档这个会话” | | 回答 DSH 的问题 | “选第二个”“用中文就好” | | 自由聊天 | “什么是全双工语音交互?” | 麦克风与隐私 duet 通过服务器提供语音服务。根据所使用的功能,以下信息会上传至服务器,用于理解语音、执行会话操作、生成回复和语音播报: - 交互模式开启期间,麦克风采集的交互音频。 - 交互所需的会话信息,例如会话标识、名称、运行状态和当前会话名称。 - 交互所需的输入框内容、任务结果。 请勿在交互中提供密码、密钥等敏感内容。 目前仅支持中文。 许可证 Copyright 2026 YuMS。本项目采用 Apache License 2.0。 第三方图标的许可声明见 HEROICONS-LICENSE.txt。