dsh-voice
DeepSeek Harness 语音工具插件,提供 Edge TTS 语音合成、兼容 OpenAI 的 ASR 转写和音色列表。
安装
$ dsh plugin --profile web add dsh-voice插件能力与用途
基于公开仓库快照由 AI 辅助整理,内容必须有源码依据;它不等同于兼容性验证或安全验证。
核心能力
- 提供 voice_tts 工具,将文本合成为 MP3 音频。
- 提供 voice_stt 工具,通过兼容 OpenAI 的 ASR 端点转写音频。
- 提供 voice_list 工具,列出常用音色选项。
- 支持配置 ASR 引擎、模型、API 密钥、默认 TTS 音色和代理地址。
- 通过原生 WebSocket 直连 Edge TTS,并支持可选代理隧道。
- 对最长 5,000 字符的 TTS 文本和最大 25 MB 的音频进行前置校验。
适用场景
- 生成语音播报、简报或 Agent 回复。
- 使用可选音色生成多语言语音输出。
- 转写会议录音或其他音频文件。
- 将转写工作流连接到 Groq、OpenAI 或自定义兼容 ASR 服务。
适合谁
- 构建语音 Agent 的 DeepSeek Harness 用户。
- 需要通过 DSH 工具生成语音输出的用户。
- 拥有兼容 OpenAI 的语音识别 API 服务访问权限的用户。
文档中可确认的限制
- 语音转文字需要配置 ASR API 密钥及兼容端点。
- TTS 文本输入限制为 5,000 个字符。
- 用于转写的音频限制为 25 MB。
- 该包要求 Node.js 22 或更高版本。
- TTS 行为依赖 Edge TTS 协议。
DSH 兼容性
DSH Plugin 针对具体版本记录的运行验证证据。没有结果只代表我们尚未测试,不代表不兼容。
安全信号
来自包元数据和源码检查的客观信号。这些信息用于辅助判断,不代表绝对安全保证。
package.json 声明了 3 个运行依赖、3 个开发依赖、0 个 Peer 依赖和 0 个可选依赖。
package.json 中声明了 DSH Bundle 元数据。
GitHub 报告该仓库许可证为 MIT。
已获取仓库根目录 package.json,可用于 Registry 元数据检查。
本次 Registry 快照已获取公开 GitHub 源码元数据。
来源与 Registry 记录
展示此条目的公开来源、Registry 分类与最近一次源码检查信息,并与运行验证结果明确分开。
- 源码仓库
- STARDUSTLC666/dsh-voice
- Registry 来源
- GitHub · dsh-plugin topic
- Registry 分类
- Plugin
- 源码检查
- a8b2ef7 · 2026-09-21
本页面基于公开源码信息独立收录。DSH Plugin 与 DeepSeek 及插件作者均无隶属关系;安装前请始终以作者仓库中的最新说明为准。
仓库活跃度
- GitHub Stars
- 3GitHub stars
- Fork 数
- 0
- 未关闭 Issue
- 0
- 最近提交
- 2026-09-18
- 最近发布
- 未发现 Release
相关 DSH 插件
综合核心能力、适用场景、插件类型、分类和 DSH Profile 进行相关性排序。
支持多云端模型与本地 ComfyUI 的 DeepSeek Harness 对话图像生成与连续编辑插件。
查看插件 →面向 DeepSeek Harness 的原生视觉工具箱,提供图片问答、OCR、目标定位、UI 还原、像素对比与视觉产物。
查看插件 →为 DeepSeek Harness 智能体提供视觉路由与像素级图像工具链,内置免费免 Key 视觉后备通道。
查看插件 →适用于 DeepSeek Harness 的网络安全红队评测与提示词管理插件,提供受控策略修补与演练台。
查看插件 →