DeepSeek Harness 插件
DeepSeek Harness 插件Manifest 有效

dsh-voice

为 DeepSeek Harness 提供全双工语音功能:本地 SenseVoice ASR、流式 Edge TTS、字幕与语音打断。

开发者工具浏览器与 Web
4GitHub Stars6Fork 数更新于2026-08-23

安装

$ dsh plugin --profile web add <repo-url-or-path>

插件能力与用途

基于公开仓库快照由 AI 辅助整理,内容必须有源码依据;它不等同于兼容性验证或安全验证。

源码有据
dsh-voice 为 DeepSeek Harness 增加网页端语音模式。它录制麦克风音频并在主机端用 SenseVoice 转写,将语音提交到编辑器,并通过 Edge TTS 朗读流式模型回复;用户再次说话时可停止播放并取消正在运行的轮次。

核心能力

  • 录制麦克风音频,并将原始 PCM 发送到主机端 SenseVoice ASR。
  • 提供面向简体中文的语音识别,包括标点、逆文本规范化和可配置的自动语言选择。
  • 将模型流式回复按句分段,通过 Edge TTS 播放,并显示实时字幕。
  • 支持语音打断:清除本地播放、丢弃排队或进行中的合成,并取消正在运行的轮次。
  • 提供 SSE、ASR、取消、配置和 Hugging Face 模型代理路由。
  • 将下载的 ASR 模型缓存到磁盘,并可通过 npm run prefetch 预热缓存。
  • 提供切换式和按住式麦克风模式,以及可选的自动发送。

适用场景

  • 在 DeepSeek Harness 中进行免手操作的语音对话。
  • 使用主机端转写进行中文语音输入。
  • 在语音回复播放期间打断并提出新问题。
  • 通过兼容 Hugging Face 的镜像下载 ASR 模型。

适合谁

  • 希望使用麦克风输入和语音回复的 DeepSeek Harness 网页配置用户。
  • 需要 SenseVoice 转写功能的中文用户。
  • 需要配置主机端语音模型和本地模型缓存的开发者。

文档中可确认的限制

  • 由于使用 node:zlib 的 zstd API,需要 Node.js 22.19+ 或 24+。
  • 除非预热缓存,ASR 模型文件会在首次使用时下载。
  • 语音打断依赖浏览器回声消除;由于没有 JavaScript 级别的 AEC,在部分平台上较大的 TTS 音量可能会漏入麦克风。
  • 文档中的安装方式面向 DeepSeek Harness 的 web profile。

DSH 兼容性

DSH Plugin 针对具体版本记录的运行验证证据。没有结果只代表我们尚未测试,不代表不兼容。

尚未测试目前还没有发布运行兼容性测试结果。

安全信号

来自包元数据和源码检查的客观信号。这些信息用于辅助判断,不代表绝对安全保证。

依赖数量

package.json 声明了 2 个运行依赖、8 个开发依赖、3 个 Peer 依赖和 0 个可选依赖。

信息
已声明 DSH Bundle

package.json 中声明了 DSH Bundle 元数据。

信息
已声明许可证

GitHub 报告该仓库许可证为 MIT。

信息
已获取 package.json

已获取仓库根目录 package.json,可用于 Registry 元数据检查。

信息
源码可用

本次 Registry 快照已获取公开 GitHub 源码元数据。

信息

来源与 Registry 记录

展示此条目的公开来源、Registry 分类与最近一次源码检查信息,并与运行验证结果明确分开。

源码仓库
haoku123/dsh-voice
Registry 来源
GitHub · dsh-plugin topic
Registry 分类
Plugin
源码检查
e1ed20a · 2026-09-13

本页面基于公开源码信息独立收录。DSH Plugin 与 DeepSeek 及插件作者均无隶属关系;安装前请始终以作者仓库中的最新说明为准。

仓库活跃度

GitHub Stars
4GitHub stars
Fork 数
6
未关闭 Issue
0
最近提交
2026-08-23
最近发布
2026-08-17
插件维护者

你在维护这个插件吗?

此条目根据公开仓库数据生成。如果你维护该项目,可以检查页面信息;如果你认为这个条目对用户有帮助,也可以在 README 或项目资源中引用它。

添加到 README
已收录于 DSHPlugin.app