DeepSeek Harness Hub
← 返回列表

TalkingRainTuT/dsh-VoiceChat

DeepSeek Harnessspec-screened在 GitHub 查看 ↗
未验证

让 DeepSeek Harness 的 agent 开口说话的实时语音聊天插件动态 Cordis 插件。

尚未跑自动兼容性验证,可查看页面内的依赖与入口分析。 · 最近上游提交 2026/8/23 · 已提供中文文档

一个DSH的语音聊天插件 | Realtime voice chat plugin for DeepSeek Harness: configurable translate + multi-TTS + auto-start local servers.

综合分
28.8
GitHub 分
28.8
用户评分
★ Stars
2
周下载量
安装插件(需先安装 dsh CLI 引擎:npm install -g @deepseek-ai/dsh)
dsh plugin --profile web add TalkingRainTuT/dsh-VoiceChat
该插件未发布到 npm,走 GitHub 源安装(pnpm 若拦截 prepare 脚本,按其提示在 pnpm-workspace.yaml 的 allowBuilds 中放行后重跑)
数据截至 2026/9/19(元数据每日更新 · 实装验证按队列轮转,单条结论的验证时间见上方)
用户评分
还没有人投票,来当第一个
订阅周报,不错过优质插件更新
每周一封 · 高评分插件 + 新用户活动

README

dsh-VoiceChat

每条助手消息自动:按需翻译 → 所选 TTS 合成 → 自动播放,消息末尾带 🔊/⏸/▶ 按钮(播放/暂停/继续/重播)。

特性

- 条件翻译:仅当 voiceLanguage ≠ aiLanguage 时才调用翻译接口;相同则直接合成原文
- OpenAI 兼容翻译:可配 baseUrl/model/apiKey(默认 DeepSeek;换成 OpenAI 只需改 baseUrl/model)
- 多 TTS 提供方:本地(Style-Bert-VITS2 / GPT-SoVITS)+ 免费云端(edge-tts)+ 云端(OpenAI / DashScope / Qwen-TTS / ElevenLabs)
- autoStart:插件激活时按配置自动拉起本地 TTS 服务(健康检查,不重复启动)
- 长文本:按各提供方 maxChunk 分段合成后自动拼接

安装

本地源码安装
dsh plugin --profile web add "file:/path/to/dsh-VoiceChat"

或发布到 npm 后
dsh plugin --profile web add dsh-VoiceChat

目录结构

dsh-VoiceChat/
├── speak.mjs           # 执行脚本:翻译 + 可插拔 TTS + 分段拼接
├── config.json         # 配置
├── config.example.json # 配置示例
├── package.json        # 依赖(edge-tts 需要 ws / https-proxy-agent)
├── LICENSE             # MIT
├── played.json         # 已自动播放清单(运行产物)
├── wav/                # 生成音频(运行产物)
├── lib/
│   ├── host.mjs        # 插件 Host 半身源码
│   ├── client.mjs      # 插件 Client 半身源码
│   └── edge-tts.mjs    # edge-tts 协议实现(源自 dsh-voice,MIT)
└── .gitignore

快速开始

1. 将本目录放到 会话工作区(默认 ~/.dsh)下的 .dsh-VoiceChat 文件夹
(Host 用工作区相对路径 .dsh-VoiceChat 定位,可跨机器)
2. npm install(或本地已有 node_modules 则建联接)
3. 复制 config.example.json → config.json,填入密钥与提供方
4. 激活插件(见下)

配置说明(config.json)

{
"translator": {            // OpenAI 兼容翻译接口
"apiKey": "sk-...",      // DeepSeek 或 OpenAI 的 key
"baseUrl": "https://api.deepseek.com",  // 或 https://api.openai.com/v1
"model": "deepseek-chat",               // 或 gpt-4o-mini
"targetLanguage": "ja"
},
"aiLanguage": "zh",        // AI 回复使用的语言
"voiceLanguage": "ja",     // 语音目标语言(可配置;与 aiLanguage 相同则跳过翻译)
"ttsProvider": "opentts",   // 语音生成模型
"nodePath": "",            // node 可执行文件(空则自动解析)
"autoStart": { "enabled": true, "servers": [ { "name": "...", "command": "...", "args": [...], "cwd": "...", "healthUrl": "..." } ] }
}

TTS 提供方

| provider | 类型 | 说明 | 必需配置 |
| :-- | :-- | :-- | :-- |
| style-bert-vits2 | 本地 | server_fastapi /voice(默认) | url, modelId, speakerId |
| gpt-sovits | 本地 | POST /tts(api_v2) | url, refAudioPath |
| edge-tts | 云端免费 | 微软 Edge 朗读 | voice(如 ja-JP-NanamiNeural) |
| openai | 云端/本地 | /audio/speech,兼容 OpenAI 协议本地服务 | apiKey, voice |
| dashscope | 云端(阿里) | 通义 sambert text2audio | apiKey, voice |
| qwen-tts | 云端(阿里) | 通义 qwen-tts | apiKey, voice |
| elevenlabs | 云端 | ElevenLabs | apiKey, voiceId |

License

MIT

上游仓库有新提交时邮件通知你(每天最多一封,无更新不打扰),随时一键退订。

💬 加入 DPharness 群聊

插件用法、部署报错、新插件第一时间同步——群里问,比一个人翻文档快。

点击加入 QQ 群
DPharness 群聊二维码,手机 QQ 扫码进群
扫码进群