DeepSeek Harness Hub
← 返回列表

STARDUSTLC666/dsh-voice

DeepSeek Harnessspec-screened在 GitHub 查看 ↗
✓ 可直接安装

DSH 语音双件套插件:voicettsedge-tts 协议零成本微软神经语音合成/ voicesttOpenAI…

自动检查通过:npm 包已发布且 engines 声明满足基线(声明 Node ^22.19.0 || >=24.0.0);该结论来自程序自动检查,未经人工实机验证。 · 最近上游提交 2026/9/19 · 已提供中文文档

DSH 语音双件套插件:voice_tts(edge-tts 协议零成本微软神经语音合成)/ voice_stt(OpenAI 兼容 ASR 语音转文字)/ voice_list(音色列表),原生 WebSocket + 插件级代理。

综合分
32.3
GitHub 分
32.3
用户评分
★ Stars
3
周下载量
安装插件(需先安装 dsh CLI 引擎:npm install -g @deepseek-ai/dsh)
dsh plugin --profile web add dsh-voice
npm 包 dsh-voice 已校验归属本仓库,走 npm 安装最省事
数据截至 2026/9/19(元数据每日更新 · 实装验证按队列轮转,单条结论的验证时间见上方)
安装兼容性检查✓ 自动检查通过

以下结论由程序自动检查 npm 包、engines 声明与入口文件得出,未做人工实机验证——能装不等于用着没问题。

npm 包dsh-voice @ 0.3.4
Node 引擎要求 ^22.19.0 || >=24.0.0 · 基线 Node 22.19 满足
dsh CLI 依赖未声明 dsh 版本约束
入口文件main/exports/bin 已声明

验证方式:npm registry 存在性 + package.json 静态校验 · 最后验证 2026/9/19 01:12:49

用户评分
还没有人投票,来当第一个
订阅周报,不错过优质插件更新
每周一封 · 高评分插件 + 新用户活动

README

English

dsh-voice

你的 agent 会说话了:edge-tts 微软神经语音免费无限量 + Whisper 转写。

npm version npm downloads license stars

Awesome DSH Plugin

DSH(DeepSeek Harness)语音双件套插件:让 agent 会说话、能听懂。

- voice_tts:文字转语音,走 edge-tts 协议(微软 Edge 朗读服务,免费无限量,22+ 常用音色)
- voice_stt:语音转文字,走 OpenAI 兼容 ASR 接口(Groq / OpenAI / 自定义端点)
- voice_list:音色清单
- voice_preview:音色试听,用一段样例文本批量生成短 MP3,挑音色不用盲选
- voice_health:配置自检,体检 TTS 音色 / ASR 密钥 / 接口地址 / 代理(不联网)

兼容性

已在官方 @deepseek-ai/dsh@0.1.5-rc.1、Node 24.16.0 上验证(2026-09-11):18 个组件与 Modlens 同载,工具 schema、技能注册及离线只读调用检查通过。采用 cordis.patch.yml + dsh.bundle.patch 组合包模型。Node 要求与该版本 Harness 一致:22.19 及以上的 22.x,或 24 及以上。外部服务的实际业务操作需按各组件配置单独验证。

安装

dsh plugin --profile web add dsh-voice

卸载

dsh plugin --profile web remove dsh-voice

卸载后重启 Web 服务。如需彻底清理,可再手动删除自己 profile cordis.patch.yml 中覆盖的插件行。

配置

voice_tts 零配置可用;voice_stt 需要 ASR 密钥:

- id: voice
name: 'dsh-voice'
config:
asrEngine: groq                       # groq | openai | custom
asrModel: whisper-large-v3-turbo      # groq 的 whisper 模型
asrApiKey: gsk_...                  # 推荐改用环境变量 DSH_VOICE_ASR_KEY
ttsVoice: zh-CN-XiaoxiaoNeural        # 默认音色
proxyUrl: http://127.0.0.1:7890     # ASR 接口需要特殊代理时启用

工具一览

| 工具 | 作用 | 关键参数 |
| :-- | :-- | :-- |
| voice_tts | 文字合成 MP3(免费) | text 必填;voice/rate/pitch/output 可选 |
| voice_stt | 音频转文字 | audio 必填;engine/model/language/prompt/output 可选 |
| voice_list | 常用音色清单 | 无 |
| voice_preview | 音色试听:批量生成短样例 MP3 | voices(≤8 个)/ text / outputDir 可选 |
| voice_health | 配置自检(不联网) | 无 |

示例

voice_tts { text: 今天的 AI 早报来了 }                    # 晓晓女声,输出 voice_output.mp3
voice_tts { text: hello, voice: en-US-AriaNeural }        # 英文女声
voice_stt { audio: E:\audio\meeting.mp3, language: zh } # 转写会议录音
voice_list {}
voice_preview { voices: [zh-CN-XiaoxiaoNeural, en-US-AriaNeural] } # 生成两个试听样例
voice_health {}                                          # 自检 TTS / ASR / 代理配置

硬核细节

- edge-tts 协议直连:Sec-MS-GEC 令牌按官方 DRM 算法本地生成(SHA256(Windows 文件时间 + TrustedClientToken),5 分钟窗口),WS 传输用 ws 库 + permessage-deflate 压缩 + 可选 HTTP CONNECT 代理隧道
- 零 API 成本:TTS 完全免费;STT 只花你选的 ASR 接口的钱
- 文本 ≤5000 字符、音频 ≤25MB 前置校验;输出同名自动加序号
- 协议对齐开源 edge-tts 当前版本(7.x),不依赖过时的令牌端点

开发

pnpm install
pnpm test       # 构建 + 离线单元测试(使用模拟的 TTS/ASR)
pnpm test:integration  # 显式联网,调用真实 edge-tts;网络或断言失败均报错

License

MIT

版本记录

- 0.3.4(2026-09-18):修复代理路径 STT 上传 [object FormData]、25MB 校验在读入之后、输出目录不存在白烧一次合成、默认输出落宿主 cwd;exec.signal 全程透传、preview 改 3 路并发。测试 55 项。

上游仓库有新提交时邮件通知你(每天最多一封,无更新不打扰),随时一键退订。

同作者(STARDUSTLC666)的其他插件

💬 加入 DPharness 群聊

插件用法、部署报错、新插件第一时间同步——群里问,比一个人翻文档快。

点击加入 QQ 群
DPharness 群聊二维码,手机 QQ 扫码进群
扫码进群