dsh-voice
为 DeepSeek Harness 提供全双工语音功能:本地 SenseVoice ASR、流式 Edge TTS、字幕与语音打断。
安装
$ dsh plugin --profile web add <repo-url-or-path>插件能力与用途
基于公开仓库快照由 AI 辅助整理,内容必须有源码依据;它不等同于兼容性验证或安全验证。
核心能力
- 录制麦克风音频,并将原始 PCM 发送到主机端 SenseVoice ASR。
- 提供面向简体中文的语音识别,包括标点、逆文本规范化和可配置的自动语言选择。
- 将模型流式回复按句分段,通过 Edge TTS 播放,并显示实时字幕。
- 支持语音打断:清除本地播放、丢弃排队或进行中的合成,并取消正在运行的轮次。
- 提供 SSE、ASR、取消、配置和 Hugging Face 模型代理路由。
- 将下载的 ASR 模型缓存到磁盘,并可通过 npm run prefetch 预热缓存。
- 提供切换式和按住式麦克风模式,以及可选的自动发送。
适用场景
- 在 DeepSeek Harness 中进行免手操作的语音对话。
- 使用主机端转写进行中文语音输入。
- 在语音回复播放期间打断并提出新问题。
- 通过兼容 Hugging Face 的镜像下载 ASR 模型。
适合谁
- 希望使用麦克风输入和语音回复的 DeepSeek Harness 网页配置用户。
- 需要 SenseVoice 转写功能的中文用户。
- 需要配置主机端语音模型和本地模型缓存的开发者。
文档中可确认的限制
- 由于使用 node:zlib 的 zstd API,需要 Node.js 22.19+ 或 24+。
- 除非预热缓存,ASR 模型文件会在首次使用时下载。
- 语音打断依赖浏览器回声消除;由于没有 JavaScript 级别的 AEC,在部分平台上较大的 TTS 音量可能会漏入麦克风。
- 文档中的安装方式面向 DeepSeek Harness 的 web profile。
DSH 兼容性
DSH Plugin 针对具体版本记录的运行验证证据。没有结果只代表我们尚未测试,不代表不兼容。
安全信号
来自包元数据和源码检查的客观信号。这些信息用于辅助判断,不代表绝对安全保证。
package.json 声明了 2 个运行依赖、8 个开发依赖、3 个 Peer 依赖和 0 个可选依赖。
package.json 中声明了 DSH Bundle 元数据。
GitHub 报告该仓库许可证为 MIT。
已获取仓库根目录 package.json,可用于 Registry 元数据检查。
本次 Registry 快照已获取公开 GitHub 源码元数据。
来源与 Registry 记录
展示此条目的公开来源、Registry 分类与最近一次源码检查信息,并与运行验证结果明确分开。
- 源码仓库
- haoku123/dsh-voice
- Registry 来源
- GitHub · dsh-plugin topic
- Registry 分类
- Plugin
- 源码检查
- e1ed20a · 2026-09-13
本页面基于公开源码信息独立收录。DSH Plugin 与 DeepSeek 及插件作者均无隶属关系;安装前请始终以作者仓库中的最新说明为准。
仓库活跃度
- GitHub Stars
- 4GitHub stars
- Fork 数
- 6
- 未关闭 Issue
- 0
- 最近提交
- 2026-08-23
- 最近发布
- 2026-08-17
相关 DSH 插件
综合核心能力、适用场景、插件类型、分类和 DSH Profile 进行相关性排序。
适用于 DeepSeek Harness Web 界面的 Codex 风格 @file 文件引用与工作区路径选择器。
查看插件 →面向 DeepSeek Harness 的 VSCode 风格侧边栏与底部面板工作台底座,集成终端、编辑器、Git 审查及插件扩展接口。
查看插件 →DeepSeek Harness 的一站式上下文洞察与可视化管理插件,提供 Context 面板与 /context 命令。
查看插件 →将本机 Wallpaper Engine 壁纸与液态玻璃主题接入 DSH 网页界面。
查看插件 →