← 返回列表
✓ 可直接安装
一款为 DeepSeek Harness DSH 打造的本地优先、免手动语音助手插件。
自动检查通过:npm 包已发布且 engines 声明满足基线;该结论来自程序自动检查,未经人工实机验证。 · 最近上游提交 2026/9/25 · 已提供中文文档
面向 DSH 的本地优先语音对话。在你自己的机器上运行语音识别和语音合成,并可选使用外部提供程序。
综合分
31.5
GitHub 分
31.5
用户评分
—
★ Stars
2
周下载量
—
安装插件(需先安装 dsh CLI 引擎:npm install -g @deepseek-ai/dsh)
dsh plugin --profile web add dsh-live-voicenpm 包 dsh-live-voice 已校验归属本仓库,走 npm 安装最省事
信任档位:已验证本站已于 3 天前真实安装成功(L4 · 真实安装)
- 是什么
- dsh 原生插件 · chat
- 装得上吗
- 本站已真实安装成功(L4 · 真实安装,非静态推断)
- 安全吗
- 本站尚未对该插件做风险分级(暂未覆盖,不等同于无风险)
- 还在维护吗
- 活跃:最近一次提交在 1 天前
档位由下列信号合成:本站实装验证(真实安装,当前最高到 L4)· 验证所用 dsh 版本 · 静态安装检查 · 风险分级 · 仓库维护状态。下方各区块是它的证据明细。 验证判据与等级说明 →
🟢实装验证通过· 2026/9/23
由本站实装验证器在真实 dsh 环境安装成功,非静态推断。
数据截至 2026/9/25(元数据每日更新 · 实装验证按队列轮转,单条结论的验证时间见上方)
安装兼容性检查✓ 自动检查通过
以下结论由程序自动检查 npm 包、engines 声明与入口文件得出,未做人工实机验证——能装不等于用着没问题。
✓npm 包dsh-live-voice @ 0.2.2
✓Node 引擎未声明 engines.node
✓dsh CLI 依赖未声明 dsh 版本约束
✓入口文件main/exports/bin 已声明
验证方式:npm registry 存在性 + package.json 静态校验 · 最后验证 2026/9/20 14:00:39
用户评分
还没有人投票,来当第一个
订阅周报,不错过优质插件更新
每周一封 · 高评分插件 + 新用户活动
README
由 DeepSeek 最新模型翻译生成DSH 实时语音 npm version DSH License: Apache-2.0 一款为 DeepSeek Harness (DSH) 打造的本地优先、免手动语音助手插件。 诞生于巴西 🇧🇷,每天在 macOS 上用巴西葡萄牙语进行测试。 开口说话、聆听回应、回答问题并编写代码,全程无需触碰键盘。DSH 实时语音将语音转文本(STT)和文本转语音(TTS)协调为单一、无冲突的对话流程。 ⚡ 快速开始 使用 npx dsh 将插件安装到你的 DSH web 配置中: npx dsh plugin add --profile web dsh-live-voice 下次启动 DSH 后,打开 DSH 设置 → 实时语音。 🌍 界面语言 DSH 实时语音的插件界面已翻译为以下语言。此处指的是可见的插件 UI——而非语音识别或文本转语音的语言支持。 - 🇺🇸 英语 - 🇧🇷 葡萄牙语(巴西) - 🇪🇸 西班牙语 - 🇫🇷 法语 - 🇮🇳 印地语 - 🇨🇳 中文 📚 文档 深入了解引擎与配置的详细指南: - ⚙️ 配置与对话流程指南 — 设置概览、扬声器与耳机模式、时序图、静音延迟以及外部引擎设置。 - 🧠 选择语音识别引擎 — 浏览器 STT、Qwen3 ASR 与 Whisper 之间的对比,包括内存占用和操作系统兼容性。 - 📖 项目背后的故事 — 为什么要构建这个项目,以及协调语音背后的人文故事。 🎯 我应该使用哪个语音引擎? | 场景 | 推荐 | 内存 | 原因 | | --- | --- | --- | --- | | 🇧🇷 macOS 上的葡萄牙语 | Qwen3 ASR (HTTP API) | ~3 GB | 维护者日常使用中准确率最佳。Whisper 是第二选择。 | | 🇺🇸 macOS 上的英语 | 浏览器 SpeechRecognition | ~0 GB | macOS/浏览器内置 API。速度快,零额外内存。 | | 🪟 Windows | Qwen3 ASR 或 Whisper HTTP | ~2–3 GB | 推荐的起点;Windows 浏览器 STT 表现参差不齐。 | | 🌐 多语言 / 其他 | Whisper HTTP (auto) | ~2 GB | 跨数十种语言的自动语言检测。 | 👉 关于模型要求和服务器设置,请参阅选择语音引擎。 ✨ 功能一览 - 🎙️ 语音输入: 直接对着 DSH 编辑器说话,并实时显示临时转写内容。 - 👐 免手动对话: 跨聊天会话持续保持活跃的连续对话。 - ❓ 语音结构化提问: 朗读 DSH 提示问题,并提交你的语音回答。 - ⌨️ 按住说话(按键通话): 在页面任意位置按住 Control 即可说话;松开即发送。 - 🎧 声学模式隔离: 针对扬声器的门控监听(无回声),以及针对耳机的开放麦克风打断。 - 🗣️ 语音命令: 使用 “send”、“mute”、“clear” 和 “stop speaking” 等短语控制聊天。 - 🧹 智能代码过滤: 自动跳过或总结大型代码块,而不是朗读出语法。 - 🏠 本地优先与隐私: 音频在你的机器上本地运行(通过浏览器 API、Apple MLX 或 whisper.cpp);无外部语音遥测。 - 🌐 支持远程的主机音频: Qwen 和 macOS Say 在 DSH 主机上合成,然后 DSH 将紧凑的音频传输到你的浏览器——因此播放可通过远程和局域网连接正常工作。 🧑💻 即将推出:会议模式 会议模式 是为协作编码对话规划的一项差异化功能。它将在 DSH 编辑器中保留两个独立的实时转录流:你的麦克风作为 “Me:”,来自明确共享的屏幕/系统音频流的会议参与者作为 “Them:”。这会创建代码审查或技术讨论的可编辑实时记录,因此你可以在会议上下文已存在于编辑器中的情况下,手动向 DSH 提问。 它绝不会自动发送转录内容,也不会将会议音频用于语音命令。共享系统音频始终需要明确的浏览器权限,并取决于浏览器和操作系统的支持。 🤝 致谢与社区 倾听和说话应该协同工作。衷心感谢 GooDAnDReaDY 的 dsh-voice 以及 Alan2Z 的 dsh-speak,它们启发了这个统一的协调器。阅读完整故事。 我每天使用 DSH Live Voice 至少 8 小时。欢迎反馈、想法和贡献: - 提交 Issue - 发送 Pull Request 📄 许可证 Apache-2.0