🎁 福利专区全网大模型免费应用 + 新用户福利 + 注册活动入口,低成本玩转 AI
广告☁️ 云服务器特惠阿里云首购 8 折 · 腾讯云合作特惠
DeepSeek Harness Hub
← 返回列表

maoyuching/dsh-voice-chat

DeepSeek Harnessspec-screened扫描:中风险在 GitHub 查看 ↗
✓ 可直接安装

豆包式语音对话插件DeepSeek Harness Web GUI:点一下 🎤 说话,AI…

自动检查通过:npm 包已发布且 engines 声明满足基线(声明 Node >=22);该结论来自程序自动检查,未经人工实机验证。 · 最近上游提交 2026/9/25 · 已提供中文文档
综合分
31.5
GitHub 分
31.5
用户评分
—
★ Stars
2
周下载量
—
安装插件(需先安装 dsh CLI 引擎:npm install -g @deepseek-ai/dsh)
dsh plugin --profile web add dsh-voice-chat
npm 包 dsh-voice-chat 已校验归属本仓库,走 npm 安装最省事
信任档位:已验证本站已于 1 天前真实安装成功(L4 · 真实安装)
是什么
dsh 原生插件 · market
装得上吗
本站已真实安装成功(L4 · 真实安装,非静态推断)
安全吗
本站尚未对该插件做风险分级(暂未覆盖,不等同于无风险)
还在维护吗
活跃:最近一次提交在 0 天前

档位由下列信号合成:本站实装验证(真实安装,当前最高到 L4)· 验证所用 dsh 版本 · 静态安装检查 · 风险分级 · 仓库维护状态。下方各区块是它的证据明细。 验证判据与等级说明 →

🟢实装验证通过· 2026/9/24
由本站实装验证器在真实 dsh 环境安装成功,非静态推断。
数据截至 2026/9/26(元数据每日更新 · 实装验证按队列轮转,单条结论的验证时间见上方)
安装兼容性检查✓ 自动检查通过

以下结论由程序自动检查 npm 包、engines 声明与入口文件得出,未做人工实机验证——能装不等于用着没问题。

✓npm 包dsh-voice-chat @ 0.3.1
✓Node 引擎要求 >=22 · 基线 Node 22.19 满足
✓dsh CLI 依赖未声明 dsh 版本约束
✓入口文件main/exports/bin 已声明

验证方式:npm registry 存在性 + package.json 静态校验 · 最后验证 2026/9/21 23:46:05

用户评分
还没有人投票,来当第一个
订阅周报,不错过优质插件更新
每周一封 · 高评分插件 + 新用户活动

README

由 DeepSeek 最新模型翻译生成
dsh-voice-chat

豆包式语音对话插件(DeepSeek Harness Web GUI):点一下 🎤 说话,AI 回复自动用语音“汇报”给你。

📖 完整使用手册见 MANUAL.md(安装/操作/配置/FAQ/原理)。

功能

- 语音输入:点 🎤 开始聆听(“叮”提示音)→ 说话 → 停顿 2.5s 自动结束(“咚”)→ 转写并发送;
- 语音输出:AI 回复经 TTS 合成朗读,语速 +10%;设置里可开「转述朗读」(默认关闭)——开启后较长回复会先由 LLM 以“助手本人”口吻收敛转述(≤原文长度、不发散、去代码表格)再播报,转述用模型自动跟随当前对话在用的 LLM;
- ASR 引擎:支持 SiliconFlow(SenseVoice,国内免费)、Groq(Whisper)、小米 MiMo(chat/completions 协议)、自定义 OpenAI 兼容端点,在设置页面切换;
- TTS 引擎:支持 Edge TTS(微软免费)、小米 MiMo TTS(chat/completions 协议,内置多款中文音色)、自定义 TTS(OpenAI 兼容接口);
- 引擎配置隔离:ASR/TTS 每个引擎各存一份 Base URL / 模型 / API Key / 音色,切换引擎不会互相覆盖(旧版单份配置自动迁移);
- 单信道播报:新回复抢占旧播报、按快捷键/点按钮立即打断,同一时刻只有一种声音;
- 防重播:按会话记住已播报的回复,重进会话不重复朗读;
- 静音开关 🔊:正在播报时点它立刻静音,再点恢复自动朗读;
- 设置入口:DSH 自带设置弹窗(左下角齿轮 → 左侧「voice chat」类目),保存即生效无需重启;
- 快捷键:Ctrl+Shift+Space 切换麦克风(备用 Ctrl+M / Ctrl+Shift+M)。

环境要求

- DeepSeek Harness(dsh):已安装并运行 Web GUI(dsh web);
- Node.js ≥ 22(宿主与浏览器端均需要;edge-tts 客户端基于 ws,无需额外运行时);
- 浏览器:Chrome / Edge(录音需要 MediaRecorder 支持);
- ASR 密钥:语音转文字需要(SiliconFlow 注册即有免费额度;MiMo 按用量计费)。

安装

方式一(推荐,已发布到 npm):
dsh plugin --profile web add dsh-voice-chat

装完重启 dsh web

注:插件自带内联 edge-tts 客户端(微软 Edge 免费朗读服务,无需任何 API key);Edge TTS 无需额外密钥,MiMo TTS / 自定义 TTS 则需配置对应密钥。

配置

⚙️ 设置面板(推荐,优先级最高)

打开 DSH 设置弹窗(左下角齿轮),左侧点「voice chat」,右侧即可改:

🎤 语音识别设置
- ASR 引擎选择(SiliconFlow / Groq / MiMo / 自定义)
- Base URL / 模型名 / API Key
- 识别后是否自动发送
- 静音自动结束时长(秒)

🔊 朗读设置
- TTS 引擎选择(Edge TTS / MiMo TTS / 自定义 TTS)
- 各引擎对应的 Base URL / 模型名 / API Key / 音色
- 长回复转述朗读开关(默认关闭)

🔒 每个引擎的配置互相隔离:ASR 的 4 个引擎、TTS 的 3 个引擎各自保存自己的
Base URL / 模型 / 密钥 / 音色,切换引擎只是“换看哪一份”,不会互相覆盖;
保存时也只写当前编辑的那一份。旧版(≤0.3.x)的单份配置会在首次启动时自动
迁移到对应引擎(MiMo 音色 → MiMo TTS、自定义地址/密钥 → 自定义 TTS,无损)。

保存后立即生效,无需重启。

📄 配置文件(低优先级)

在 profile 的 ~/.dsh/profiles/web/cordis.patch.yml 里按 id 覆盖 config(全部可选项,不改则用默认值):

- id: dsh-voice-chat
name: 'dsh-voice-chat'
config:
asrEngine: siliconflow          # siliconflow | groq | mimo | custom
asrApiKey: sk-xxxx              # ASR 密钥(旧式单槽,作用于当前引擎;或环境变量 DSH_VOICE_ASR_KEY)
asrBaseUrl: https://api.siliconflow.cn/v1
asrModel: FunAudioLLM/SenseVoiceSmall
asr:                            # 也可按引擎分别配置(优先于上面的扁平键)
custom: { baseUrl: http://127.0.0.1:8000/v1, model: whisper-v3, apiKey: sk-xxxx }
llmModel: deepseek-v4-flash     # 转述模型(fallback,正常跟随当前对话)
silenceMs: 2500
rewrite: false                  # 转述朗读开关(默认关闭,设置页可切换)
ttsEngine: edge                 # edge | mimo | custom
voice: zh-CN-XiaoxiaoNeural     # Edge 音色(旧式,等价于 tts.edge.voice)
ttsBaseUrl: https://api.openai.com/v1   # 旧式单槽,作用于当前引擎
ttsModel: tts-1
ttsApiKey: sk-xxxx
tts:                            # 按引擎隔离的 TTS 配置(优先于上面的扁平键)

上游仓库有新提交时邮件通知你(每天最多一封,无更新不打扰),随时一键退订。

💬 加入社群

插件用法、部署报错、新插件第一时间同步——群里问,比一个人翻文档快。

DPharness QQ 群二维码,QQ 扫码进群
QQ 扫码进群
DPharness 飞书群二维码,飞书扫码进群
飞书扫码进群