DeepSeek Harness 插件
DeepSeek Harness 插件Manifest 有效

dsh-vision-bridge

DeepSeek Harness 通用视觉桥接插件,为纯文本大模型提供图像解析与多通道视觉路由。

视觉与图像UI 与效率开发者工具浏览器与 Web安全与策略
1GitHub Stars0Fork 数更新于2026-09-18

安装

$ dsh plugin --profile web add @goodandready/dsh-vision-bridge

插件能力与用途

基于公开仓库快照由 AI 辅助整理,内容必须有源码依据;它不等同于兼容性验证或安全验证。

源码有据
dsh-vision-bridge 是适用于 DeepSeek Harness 的安装式插件。当纯文本对话模型接收到图像附件时,该插件可通过配置的视觉后端(DSH 目录、OpenAI 兼容端点、Ollama、LM Studio 或自定义 Webhook)自动将图像转换为文本描述,或通过 25 个专用视觉工具按需调用图像分析能力。

核心能力

  • 支持 hybrid、llm 与 tools 模式自动重写或显式调用视觉模型
  • 提供 25 个视觉分析工具(目标检测、定位裁剪、多图对比、OCR、UI 布局提取与视觉问答等)
  • 多通道路由管理(支持 DSH 目录、OpenAI 兼容 API、Ollama、LM Studio 及自定义 Webhook)与自动故障转移
  • 支持本地 Tesseract OCR 解析与无头 Chrome HTML 截图渲染
  • 集成 LRU 描述缓存与持久化存储机制
  • 内置 5 种视觉任务 Playbook 的 vision-skills 技能组
  • 提供 Web 界面设置卡片,支持通道编辑、延迟基准测试与连通性测试

适用场景

  • 为 DeepSeek 纯文本模型补充图像解析能力,避免因图片附件导致对话失败
  • 提取截图或文档中的 OCR 文本、UI 界面布局及结构化数据
  • 通过本地 Ollama 或 LM Studio 视觉模型处理敏感图像并实现自动降级容灾

适合谁

  • 使用 DeepSeek Harness 纯文本模型且需要多模态图像处理能力的用户
  • 需要在 DSH 中构建自动化视觉检索、截图分析与 OCR 工作流的开发者

文档中可确认的限制

  • 部分特定功能依赖系统外部组件:HTML 截图需要 Chrome、视频解析需要 ffmpeg、PDF 提取需要 pdftoppm、本地 OCR 需要 tesseract(缺失时会优雅降级)
  • 受配置中的单张图片体积限制(默认最大 20MB)

DSH 兼容性

DSH Plugin 针对具体版本记录的运行验证证据。没有结果只代表我们尚未测试,不代表不兼容。

尚未测试目前还没有发布运行兼容性测试结果。

安全信号

来自包元数据和源码检查的客观信号。这些信息用于辅助判断,不代表绝对安全保证。

目前还没有发布自动安全检查信号。

来源与 Registry 记录

展示此条目的公开来源、Registry 分类与最近一次源码检查信息,并与运行验证结果明确分开。

源码仓库
GooDAnDReaDY/dsh-vision-bridge
Registry 来源
GitHub · dsh-plugin topic
Registry 分类
Plugin
源码检查
ba34ca1 · 2026-09-18

本页面基于公开源码信息独立收录。DSH Plugin 与 DeepSeek 及插件作者均无隶属关系;安装前请始终以作者仓库中的最新说明为准。

仓库活跃度

GitHub Stars
1GitHub stars
Fork 数
0
未关闭 Issue
0
最近提交
2026-09-18
最近发布
2026-09-18
插件维护者

你在维护这个插件吗?

此条目根据公开仓库数据生成。如果你维护该项目,可以检查页面信息;如果你认为这个条目对用户有帮助,也可以在 README 或项目资源中引用它。

添加到 README
已收录于 DSHPlugin.app