🎁 福利专区全网大模型免费应用 + 新用户福利 + 注册活动入口,低成本玩转 AI
广告☁️ 云服务器特惠阿里云首购 8 折 · 腾讯云合作特惠
DeepSeek Harness Hub
← 返回列表

victorwads/dsh-live-voice

DeepSeek Harnessspec-screened扫描:中风险在 GitHub 查看 ↗
✓ 可直接安装

一款为 DeepSeek Harness DSH 打造的本地优先、免手动语音助手插件。

自动检查通过:npm 包已发布且 engines 声明满足基线;该结论来自程序自动检查,未经人工实机验证。 · 最近上游提交 2026/9/25 · 已提供中文文档

面向 DSH 的本地优先语音对话。在你自己的机器上运行语音识别和语音合成,并可选使用外部提供程序。

综合分
31.5
GitHub 分
31.5
用户评分
—
★ Stars
2
周下载量
—
安装插件(需先安装 dsh CLI 引擎:npm install -g @deepseek-ai/dsh)
dsh plugin --profile web add dsh-live-voice
npm 包 dsh-live-voice 已校验归属本仓库,走 npm 安装最省事
信任档位:已验证本站已于 3 天前真实安装成功(L4 · 真实安装)
是什么
dsh 原生插件 · chat
装得上吗
本站已真实安装成功(L4 · 真实安装,非静态推断)
安全吗
本站尚未对该插件做风险分级(暂未覆盖,不等同于无风险)
还在维护吗
活跃:最近一次提交在 1 天前

档位由下列信号合成:本站实装验证(真实安装,当前最高到 L4)· 验证所用 dsh 版本 · 静态安装检查 · 风险分级 · 仓库维护状态。下方各区块是它的证据明细。 验证判据与等级说明 →

🟢实装验证通过· 2026/9/23
由本站实装验证器在真实 dsh 环境安装成功,非静态推断。
数据截至 2026/9/25(元数据每日更新 · 实装验证按队列轮转,单条结论的验证时间见上方)
安装兼容性检查✓ 自动检查通过

以下结论由程序自动检查 npm 包、engines 声明与入口文件得出,未做人工实机验证——能装不等于用着没问题。

✓npm 包dsh-live-voice @ 0.2.2
✓Node 引擎未声明 engines.node
✓dsh CLI 依赖未声明 dsh 版本约束
✓入口文件main/exports/bin 已声明

验证方式:npm registry 存在性 + package.json 静态校验 · 最后验证 2026/9/20 14:00:39

用户评分
还没有人投票,来当第一个
订阅周报,不错过优质插件更新
每周一封 · 高评分插件 + 新用户活动

README

由 DeepSeek 最新模型翻译生成
DSH 实时语音

npm version
DSH
License: Apache-2.0

一款为 DeepSeek Harness (DSH) 打造的本地优先、免手动语音助手插件。
诞生于巴西 🇧🇷,每天在 macOS 上用巴西葡萄牙语进行测试。

开口说话、聆听回应、回答问题并编写代码,全程无需触碰键盘。DSH 实时语音将语音转文本(STT)和文本转语音(TTS)协调为单一、无冲突的对话流程。

⚡ 快速开始

使用 npx dsh 将插件安装到你的 DSH web 配置中:

npx dsh plugin add --profile web dsh-live-voice

下次启动 DSH 后,打开 DSH 设置 → 实时语音。

🌍 界面语言

DSH 实时语音的插件界面已翻译为以下语言。此处指的是可见的插件 UI——而非语音识别或文本转语音的语言支持。

- 🇺🇸 英语
- 🇧🇷 葡萄牙语(巴西)
- 🇪🇸 西班牙语
- 🇫🇷 法语
- 🇮🇳 印地语
- 🇨🇳 中文

📚 文档

深入了解引擎与配置的详细指南:

- ⚙️ 配置与对话流程指南 — 设置概览、扬声器与耳机模式、时序图、静音延迟以及外部引擎设置。
- 🧠 选择语音识别引擎 — 浏览器 STT、Qwen3 ASR 与 Whisper 之间的对比,包括内存占用和操作系统兼容性。
- 📖 项目背后的故事 — 为什么要构建这个项目,以及协调语音背后的人文故事。

🎯 我应该使用哪个语音引擎?

| 场景 | 推荐 | 内存 | 原因 |
| --- | --- | --- | --- |
| 🇧🇷 macOS 上的葡萄牙语 | Qwen3 ASR (HTTP API) | ~3 GB | 维护者日常使用中准确率最佳。Whisper 是第二选择。 |
| 🇺🇸 macOS 上的英语 | 浏览器 SpeechRecognition | ~0 GB | macOS/浏览器内置 API。速度快,零额外内存。 |
| 🪟 Windows | Qwen3 ASR 或 Whisper HTTP | ~2–3 GB | 推荐的起点;Windows 浏览器 STT 表现参差不齐。 |
| 🌐 多语言 / 其他 | Whisper HTTP (auto) | ~2 GB | 跨数十种语言的自动语言检测。 |

👉 关于模型要求和服务器设置,请参阅选择语音引擎。

✨ 功能一览

- 🎙️ 语音输入: 直接对着 DSH 编辑器说话,并实时显示临时转写内容。
- 👐 免手动对话: 跨聊天会话持续保持活跃的连续对话。
- ❓ 语音结构化提问: 朗读 DSH 提示问题,并提交你的语音回答。
- ⌨️ 按住说话(按键通话): 在页面任意位置按住 Control 即可说话;松开即发送。
- 🎧 声学模式隔离: 针对扬声器的门控监听(无回声),以及针对耳机的开放麦克风打断。
- 🗣️ 语音命令: 使用 “send”、“mute”、“clear” 和 “stop speaking” 等短语控制聊天。
- 🧹 智能代码过滤: 自动跳过或总结大型代码块,而不是朗读出语法。
- 🏠 本地优先与隐私: 音频在你的机器上本地运行(通过浏览器 API、Apple MLX 或 whisper.cpp);无外部语音遥测。
- 🌐 支持远程的主机音频: Qwen 和 macOS Say 在 DSH 主机上合成,然后 DSH 将紧凑的音频传输到你的浏览器——因此播放可通过远程和局域网连接正常工作。

🧑‍💻 即将推出:会议模式

会议模式 是为协作编码对话规划的一项差异化功能。它将在 DSH 编辑器中保留两个独立的实时转录流:你的麦克风作为 “Me:”,来自明确共享的屏幕/系统音频流的会议参与者作为 “Them:”。这会创建代码审查或技术讨论的可编辑实时记录,因此你可以在会议上下文已存在于编辑器中的情况下,手动向 DSH 提问。

它绝不会自动发送转录内容,也不会将会议音频用于语音命令。共享系统音频始终需要明确的浏览器权限,并取决于浏览器和操作系统的支持。

🤝 致谢与社区

倾听和说话应该协同工作。衷心感谢 GooDAnDReaDY 的 dsh-voice 以及 Alan2Z 的 dsh-speak,它们启发了这个统一的协调器。阅读完整故事。

我每天使用 DSH Live Voice 至少 8 小时。欢迎反馈、想法和贡献:
- 提交 Issue
- 发送 Pull Request

📄 许可证 Apache-2.0

上游仓库有新提交时邮件通知你(每天最多一封,无更新不打扰),随时一键退订。

💬 加入社群

插件用法、部署报错、新插件第一时间同步——群里问,比一个人翻文档快。

DPharness QQ 群二维码,QQ 扫码进群
QQ 扫码进群
DPharness 飞书群二维码,飞书扫码进群
飞书扫码进群