🎁 福利专区全网大模型免费应用 + 新用户福利 + 注册活动入口,低成本玩转 AI
广告☁️ 云服务器特惠阿里云首购 8 折 · 腾讯云合作特惠
DeepSeek Harness Hub
← 返回列表

NakamuraIA/dsh-plugin-speech

DeepSeek 客户端兼容 / 相关生态spec-screened扫描:低风险在 GitHub 查看 ↗
⚠ 装前注意

朗读 —— DeepSeek Harness 语音插件

基本兼容但装前注意:未发布到 npm registry,仅可从源码安装 · 最近上游提交 2026/9/15 · 已提供中文文档

在 DeepSeek Harness 中朗读助手回复:支持流式播放的文本转语音提供商。

综合分
32.3
GitHub 分
32.3
用户评分
—
★ Stars
4
周下载量
—
兼容 / 相关生态插件(非 dsh 原生,请按其对应运行时安装)
git clone https://github.com/NakamuraIA/dsh-plugin-speech.git
信任档位:需留意实装验证未通过
是什么
生态插件(可安装,未声明 dsh 能力)
装得上吗
实装验证未通过(dependency_conflict),装前请到仓库确认最近更新与 issue
安全吗
本站尚未对该插件做风险分级(暂未覆盖,不等同于无风险)
还在维护吗
活跃:最近一次提交在 11 天前

档位由下列信号合成:本站实装验证(真实安装,当前最高到 L4)· 验证所用 dsh 版本 · 静态安装检查 · 风险分级 · 仓库维护状态。下方各区块是它的证据明细。 验证判据与等级说明 →

⚠︎ 实装验证未通过(dependency_conflict · 2026/9/22) ——可能是验证环境差异,装前建议到 GitHub 仓库确认最近更新与 issue。
数据截至 2026/9/20(元数据每日更新 · 实装验证按队列轮转,单条结论的验证时间见上方)
安装兼容性检查⚠ 装前注意

以下结论由程序自动检查 npm 包、engines 声明与入口文件得出,未做人工实机验证——能装不等于用着没问题。

✗npm 包@nakamuraia/dsh-plugin-speech(未发布到 npm,仅可源码安装)
✓Node 引擎未声明 engines.node
✓dsh CLI 依赖未声明 dsh 版本约束
✓入口文件main/exports/bin 已声明

未发布到 npm registry,仅可从源码安装

验证方式:npm registry 存在性 + package.json 静态校验 · 最后验证 2026/9/20 18:49:39

依赖的 DSH / Cordis 模块
@deepseek-ai/schemastery@deepseek-ai/cordis
用户评分
还没有人投票,来当第一个
订阅周报,不错过优质插件更新
每周一封 · 高评分插件 + 新用户活动

README

由 DeepSeek 最新模型翻译生成
dsh-plugin-speech

朗读 —— DeepSeek Harness 语音插件

在 DeepSeek Harness 中朗读助手回复:音频在生成过程中即开始播放。

它做什么

每条已完成的助手消息在其操作行中多出一个播放控件。按下即朗读该回复,再按一次停止。「通用」设置中新增一行,用于选择服务、声音与调音。

回复以一个请求发出,音频边到达边播放,因此第一帧到达时就开始发声,而不必等整个文件。相当于把「看回答逐字出现」的体验搬到音频上。

服务提供方

| 服务 | 需要密钥 | 声音 |
|---|---|---|
| Microsoft Edge(默认) | 否 | 该服务公开完整目录,覆盖其支持的所有语言 |

新增一个提供方,只需在 src/providers/ 下加一个目录,并在 src/providers/registry.ts 中加一行——设置界面会根据该提供方声明的字段自动生成。

环境要求

- DeepSeek Harness 的 Web 界面(dsh web),版本 0.1.5-rc.2 或更新。
- 能访问语音服务的网络。除此之外没有别的:无需下载模型,Edge 提供方也不需要账号。

安装

1. 把包加入你的 harness 检出目录:

pnpm add -w @nakamuraia/dsh-plugin-speech

若想直接跟随源码,也可以从 GitHub 安装:

pnpm add -w github:NakamuraIA/dsh-plugin-speech

2. 把 speech.patch.yml 复制到检出目录旁,并用它启动 Web 界面:

dsh web --patch ./speech.patch.yml

该 patch 只添加一行 Loader 条目。条目名既是包名,也是构建产物注册所用的浏览器模块 id,两者必须保持一致——不要只改其中一个。

设置

设置打开后位于通用分区,其中朗读一行负责:

- 服务:由哪个提供方合成。
- 语言与声音:要使用目录中的哪一个。
- 速度、音量、音高:随每次请求发送给服务。
- 跳过代码:朗读时不读围栏代码与行内代码。
- 试听:按屏幕上的设置(保存与否都算)朗读一段示例。

代码块、表格以及粘贴的电子表格一律不读;链接保留文字、丢弃地址;emoji、引号与孤立符号会被去掉。句末标点保留,因为语音用它来断句。

工作原理

浏览器                      主机                        服务
──────                      ────                        ────
点击 ─ ▶ POST /speech/speak { text }
从持久化设置里
选出提供方
────────────────────────── ▶ 合成
◀ ─ 音频字节持续回流 ─ ─ ─ ─ ─ ─ ─ ─ ─ ─ ─ ─ ─ ┘
到达即播放

合成放在主机侧,因为浏览器既不能持有 API 密钥,也无法跨 CORS 访问大多数服务。浏览器只负责发文本、放字节。

开发

源码在 DeepSeek Harness 检出目录内开发,因为类型包与客户端构建预设都在那里;本仓库保存源码与构建产物。要重新构建,把 src/ 复制回检出目录的 packages/client/ui-speech/,在那里改名后运行其构建。

许可

MIT。Edge 提供方通过 msedge-tts(MIT)调用微软的朗读端点;该端点并非微软公开支持的 API,因此其可用性按尽力而为对待。

上游仓库有新提交时邮件通知你(每天最多一封,无更新不打扰),随时一键退订。

💬 加入社群

插件用法、部署报错、新插件第一时间同步——群里问,比一个人翻文档快。

DPharness QQ 群二维码,QQ 扫码进群
QQ 扫码进群
DPharness 飞书群二维码,飞书扫码进群
飞书扫码进群