跳到正文

3274375092/dsh-voice

30最近提交 2026年8月15日

dsh-voice DSH 插件

dsh-voice 在 DSH 网页界面的输入框旁添加麦克风按钮,并支持可配置的全局热键(默认 Ctrl+Space)。说话时,实时流式识别结果会回显,最终文本以普通聊天消息提交,不修改代理人格。采用自适应双引擎:主机原生 ASR(sherpa-onnx + silero VAD,离线/私密)自动回退到浏览器 Web Speech,零配置即可使用。

如何安装 dsh-voice DSH 插件

dsh plugin --profile web add @nn12138/dsh-voice

复制不会执行命令。安装 dsh-voice DSH 插件前请核对仓库和版本。

dsh-voice DSH 插件数据来源

dsh-voice DSH 插件快照日期:2026年8月16日

discovered

dsh-voice DSH 插件能做什么

  • 通过麦克风按钮或可配置热键进行语音输入
  • 实时流式识别,说话时回显部分识别结果
  • 自适应双引擎:主机原生 ASR(sherpa-onnx + silero VAD)自动回退到浏览器 Web Speech
  • 预设无关:不修改代理人格或系统提示词
  • 可选离线原生识别模型(通过 dsh-voice-models 下载)

dsh-voice DSH 插件适合哪些场景

  • 打字不便时免提聊天输入
  • 保持键盘焦点的情况下快速语音输入消息
  • 在任何预设(代码、标准、最小、自定义)下使用,不影响行为
  • 隐私敏感场景下离线语音识别(需安装原生模型)

dsh-voice DSH 插件适合谁

  • 偏好语音输入而非打字的 DSH 用户
  • 有辅助需求或临时行动不便的用户
  • 希望使用热键驱动语音工作流程的高级用户

dsh-voice DSH 插件的限制

  • 仅输入:不处理代理回复或人格修改
  • 原生 ASR 需要额外安装 sherpa-onnx-node 并下载模型(约 100 MB)
  • 浏览器 Web Speech 引擎依赖浏览器支持,可能在某些环境中不可用
  • 热键 Ctrl+Space 可能与其他系统快捷键冲突;可在配置中自定义
  • 需要麦克风权限;拒绝授权将无法使用语音输入

dsh-voice DSH 插件的仓库 README 摘录

以下文字摘自 dsh-voice DSH 插件的上游仓库 3274375092/dsh-voice 的 README,版权归原作者,仅作引用。

**English** | [中文](README.zh.md) A voice input plugin for DeepSeek Harness: click 🎤 in the web UI (or press a hotkey), speak, and the recognized text is submitted as a normal chat message. **Input only** — it never touches the agent preset/persona, so it behaves like "another input method" in every mode. [![npm](https://img.shields.io/npm/v/@nn12138/dsh-voice)](https://www.npmjs.com/package/@nn12138/dsh-voice) [![License](https://img.shields.io/badge/License-MIT-green.svg)](LICENSE) ## Features - 🎤 **Voice input**: microphone button (platform design-system UI) + configurable global hotkey (Ctrl+Space by default) - ⚡ **Live recognition**: streaming partial transcripts are echoed while you speak; VAD finalization commits on stop (0.6s tail padding keeps sentence endings) - 🧠 **Adaptive dual engine**: host-native ASR (sherpa-onnx-node zipformer2 + silero VAD, offline/private) with automatic fallback to browser Web Speech (zero extra dependencies) - 🔌 **Preset-agnostic**: does not touch the persona/system prompt; works with code/standard/minimal/custom presets - 📦 **Optional models**: zero-config out of the box; run `dsh-voice-models` when you want native offline recognition

阅读完整 README仓库许可: MIT

dsh-voice DSH 插件常见问题

如何安装 dsh-voice?

在终端中运行 `dsh plugin --profile web add @nn12138/dsh-voice`。如果需要离线原生识别,再运行 `dsh plugin --profile web add sherpa-onnx-node` 安装运行时,然后执行 `dsh-voice-models` 下载模型(约 100 MB)。安装后重启 `dsh web` 即可看到麦克风按钮。

可以修改热键 Ctrl+Space 吗?

可以。在 `~/.dsh/profiles/web/cordis.patch.yml` 的插件配置中找到 `voice` 部分,修改 `hotkey` 值(例如 `ctrl+alt+v`)。修改后重启 `dsh web` 生效。

dsh-voice 支持离线使用吗?

支持,但需要安装原生 ASR 引擎(sherpa-onnx-node)并下载模型。有模型时插件使用本地离线识别;没有模型时自动回退到浏览器 Web Speech,后者需要网络连接。

如何切换原生 ASR 和浏览器 Web Speech?

在插件配置中设置 `engine` 选项为 `native`、`browser` 或 `auto`(默认)。`auto` 会在有模型时使用原生,否则回退到浏览器。修改后重启 `dsh web`。

dsh-voice 会影响 AI 的人格或系统提示词吗?

不会。插件只将识别后的文本作为普通聊天消息发送,从不修改代理预设、人格或系统提示词,因此在所有模式(代码、标准、最小、自定义)下行为一致。