← 返回列表
未验证
在 DeepSeek Harness 中朗读助手回复——选择你自己的 TTS 提供商和语音。
尚未跑自动兼容性验证,可查看页面内的依赖与入口分析。 · 最近上游提交 2026/9/11 · 已提供中文文档
DeepSeek Harness 的多提供商 TTS(朗读回复)插件——自选提供商和语音
综合分
30.2
GitHub 分
30.2
用户评分
—
★ Stars
1
周下载量
—
兼容 / 相关生态插件(非 dsh 原生,请按其对应运行时安装)
git clone https://github.com/WYR-233/dsh-multi-tts.git数据截至 2026/9/16(元数据每日更新 · 实装验证按队列轮转,单条结论的验证时间见上方)
依赖的 DSH / Cordis 模块
@deepseek-ai/schemastery@deepseek-ai/cordis用户评分
还没有人投票,来当第一个
订阅周报,不错过优质插件更新
每周一封 · 高评分插件 + 新用户活动
README
dsh-multi-tts
在 DeepSeek Harness 中朗读助手回复——选择你自己的 TTS 提供商和语音。
英文 | 中文
一个面向 DSH 的多提供商文本转语音插件:每条助手回复旁都有一个 🔊 按钮,输入框中有自动朗读开关,还有一个设置页面,让你选择提供商、语音、情感和语速。无需构建步骤——纯 ESM + 手写 React。
功能
- 🔊 逐条回复朗读——每条助手消息上都有一个按钮;再次点击即可停止。
- 🔇 自动朗读开关——位于输入框左侧槽位;新回复会自动朗读。
- ⚙️ 多提供商设置页面——提供商下拉菜单、语音下拉菜单、手动语音 ID、情感、语速、模型、基础 URL、API 密钥,以及一键测试按钮。
- 🧹 对 TTS 友好的文本清理——朗读前会去除代码块、行内代码、URL、文件路径、Markdown 强调标记和列表项目符号。
- 🔑 灵活的密钥解析——插件配置 → 环境变量 → $DSH_HOME/.env → .env 中的常见密钥名称。
- 📦 零构建——客户端包是手写的 React.createElement,按原样放在 lib/ 中发布。
提供商
| 提供商 | 端点 | 内置语音 | 情感 |
| --- | --- | --- | --- |
| minimax | MiniMax(海螺)/v1/t2a_v2 | 12 种中文语音(例如 female-shaonv、qiaopi_mengmei、lovely_girl) | ✅ |
| openai | 任何兼容 OpenAI 的 /audio/speech | 6 种语音(alloy、echo、fable、onyx、nova、shimmer) | — |
任何兼容 OpenAI 的端点都可以通过 openai 提供商使用——只需设置基础 URL(OpenAI、DashScope、SiliconFlow、本地服务器等)。
安装
dsh plugin --profile web add dsh-multi-tts
然后将该包添加到配置文件的 bundle 列表中(dsh plugin add 只会写入依赖——真正挂载插件的是 dsh.profile.bundles):
{
"dsh": {
"profile": {
"bundles": ["dsh-multi-tts"]
}
}
}
重启 DSH,然后打开 设置 → Multi TTS / 语音朗读。
配置
1. 打开插件的设置区域。
2. 选择一个提供商,然后选择一种语音(或粘贴任意语音 ID)。
3. 粘贴 API 密钥,或将密钥放入 $DSH_HOME/.env:
MINIMAX_API_KEY=sk-...
OPENAI_API_KEY=sk-...
4. 点击 🔊 测试朗读 / Test 进行验证。当密钥来自环境时,密钥状态标签会显示 (from env/.env)。
配置存储在 $DSH_HOME/multi-tts/config.json 中(可通过 stateDir 选项覆盖该目录)。
路由
宿主端在 DSH Web 服务器上注册了四个路由:
| 方法 | 路径 | 用途 |
| --- | --- | --- |
| POST | /multi-tts/synthesize | { text, voice?, provider?, speed? } → 音频字节(字符数在 x-tts-chars 中) |
| GET | /multi-tts/status | 当前提供商 / 语音 / 密钥是否存在 |
| GET POST | /multi-tts/config | 读取 / 修补存储的配置 |
| GET | /multi-tts/voices | 当前提供商的语音列表 |
备注
- 对等依赖:@deepseek-ai/cordis ^4.0.1,由 DSH 宿主提供。
- 每次请求的文本上限为 4000 个字符。
- 需要 Node.js ≥ 22(使用全局 fetch)。
许可
MIT
中文说明
在 DeepSeek Harness 里把助手的回复念出来——服务商与音色都由你自己挑。
DSH 的多服务商语音朗读插件:每条回复旁有 🔊 朗读按钮,输入框有自动朗读开关,设置页里可选服务商、音色、情绪与语速。零构建,纯 ESM + 手写 React。
功能
- 🔊 每条回复旁朗读——点一下开口,再点一下停止。
- 🔇 自动朗读开关——输入框左侧,新回复自动念。
- ⚙️ 多服务商设置页——服务商下拉、音色下拉、手填音色 ID、情绪、语速、模型、Base URL、API Key,外加一键测试朗读。
- 🧹 朗读前文本清洗——代码块、行内代码、网址、文件路径、Markdown 强调与列表符号都不会念出来。
- 🔑 Key 多路兜底——插件配置 → 环境变量 → $DSH_HOME/.env → .env 常见键名。
- 📦 零构建——client 端是手写 React.createElement,直接以 lib/ 里的源文件形式分发。
服务商
| 服务商 | 接口 | 内置音色 | 情绪 |
| --- | --- | --- | --- |
| minimax | MiniMax(海螺)/v1/t2a_v2 | 12 个中文音色(female-shaonv 少女音、qiaopi_mengmei 俏皮萌妹、lovely_girl 萌萌女童……) | ✅ |
| openai | 任意 OpenAI 兼容 /audio/speech | 6 个音色(alloy、echo、fable、onyx、nova、shimmer) | — |
凡是 OpenAI 兼容的语音端点都能用 openai 这条通道接进来——改 Base URL 即可(OpenAI、DashScope、SiliconFlow、本地服务……)。
安装
dsh plugin --profile web add dsh-multi-tts
再把包名加进 profile 的 bundles 清单(dsh plugin add 只写依赖,bundles 才是挂载清单):
{
"dsh": {
"profile": {
"bundles": ["dsh-multi-tts"]
}
}
}
重启 DSH,打开设置 → 语音朗读。
配置
1. 打开插件设置页;
2. 选服务商、再选音色(也可直接手填音色 ID);
3. 粘贴 API Key,或写进 $DSH_HOME/.env:
MINIMAX_API_KEY=sk-...
OPENAI_API_KEY=sk-...
4. 点 🔊 测试朗读 验证。Key 来自环境变量时,状态会显示「(来自环境/.env)」。
配置存在 $DSH_HOME/multi-tts/config.json(可用 stateDir 选项改目录)。
路由
host 端在 DSH web 服务器上挂 4 条路由:
| 方法 | 路径 | 用途 |
| --- | --- | --- |
| POST | /multi-tts/synthesize | { text, voice?, provider?, speed? } → 音频字节(字符数在 x-tts-chars) |
| GET | /multi-tts/status | 当前服务商 / 音色 / 是否已配 Key |
| GET POST | /multi-tts/config | 读 / 改配置 |
| GET | /multi-tts/voices | 当前服务商的音色表 |
说明
- peer 依赖:@deepseek-ai/cordis ^4.0.1,由 DSH 本体提供。
- 单次合成文本上限 4000 字符。
- 需要 Node.js ≥ 22(用到全局 fetch)。
许可
MIT同作者(WYR-233)的其他插件
扫码进群