dsh-image-vision-bridge
一个 DeepSeek Harness 宿主插件:将聊天图片转换为视觉模型描述后提供给纯文本主模型,同时在可见聊天记录中保留原图。
安装
$ dsh plugin --profile web add dsh-image-vision-bridge # npm插件能力与用途
基于公开仓库快照由 AI 辅助整理,内容必须有源码依据;它不等同于兼容性验证或安全验证。
核心能力
- 检测 LLM 流式请求中的图片块,包括嵌套在 tool-result 内容中的图片。
- 调用已配置的视觉模型;默认通过 opencode-go 提供方使用 mimo-v2.5。
- 在重写后的模型请求中以生成的文本描述替换图片块。
- 保留原始图片,不会把视觉描述文本写入可见聊天记录或会话日志。
- 按附件 ID 在进程内缓存描述,避免重复视觉调用。
- 不含图片的请求,以及已指向配置视觉模型的请求会直接透传。
- 视觉调用失败时降级为失败说明文本,不中断对话。
适用场景
- 让主模型通过文本描述获得图片上下文,而不是直接接收图片块。
- 在聊天中保留上传图片可见,同时向回复模型提供不显示的视觉上下文。
- 在 DSH Web profile 中使用独立配置的视觉模型进行图片分析。
适合谁
- 运行 Web profile 的 DeepSeek Harness 用户。
- 已配置视觉模型路由的用户,例如使用 mimo-v2.5 的 opencode-go。
- 希望在 DSH LLM 流水线中配置图片转文本桥接的开发者。
文档中可确认的限制
- 必须在 DSH 设置中为主模型声明图片输入模态,主机 API 边界才会接受图片消息;即使插件随后会将图片转换为文本也是如此。
- 配置的视觉提供方和模型必须已在 settings.yaml 中注册。
- 由于 Web profile 禁用了 HMR,必须重启 dsh web 才会生效。
- 插件会重写进入 llm/stream 流水线的请求;README 指出这不是框架官方承诺的用法,并建议升级 DSH 前进行冒烟测试。
- 描述缓存仅存在于进程内。
- 文档所述测试环境为 DeepSeek Harness 与 dsh-llm 0.1.0-rc.6,以及 Cordis 4.0.1。
DSH 兼容性
DSH Plugin 针对具体版本记录的运行验证证据。没有结果只代表我们尚未测试,不代表不兼容。
安全信号
来自包元数据和源码检查的客观信号。这些信息用于辅助判断,不代表绝对安全保证。
package.json 声明了 0 个运行依赖、0 个开发依赖、2 个 Peer 依赖和 0 个可选依赖。
package.json 中声明了 DSH Bundle 元数据。
GitHub 报告该仓库许可证为 MIT。
已获取仓库根目录 package.json,可用于 Registry 元数据检查。
本次 Registry 快照已获取公开 GitHub 源码元数据。
来源与 Registry 记录
展示此条目的公开来源、Registry 分类与最近一次源码检查信息,并与运行验证结果明确分开。
- 源码仓库
- Icestab/dsh-image-vision-bridge
- Registry 来源
- GitHub · dsh-plugin topic
- Registry 分类
- Plugin
- 源码检查
- 61b3602 · 2026-09-14
本页面基于公开源码信息独立收录。DSH Plugin 与 DeepSeek 及插件作者均无隶属关系;安装前请始终以作者仓库中的最新说明为准。
仓库活跃度
- GitHub Stars
- 1GitHub stars
- Fork 数
- 0
- 未关闭 Issue
- 0
- 最近提交
- 2026-08-22
- 最近发布
- 未发现 Release
相关 DSH 插件
综合核心能力、适用场景、插件类型、分类和 DSH Profile 进行相关性排序。
面向 DeepSeek Harness 的原生视觉工具箱,提供图片问答、OCR、目标定位、UI 还原、像素对比与视觉产物。
查看插件 →为 DeepSeek Harness 智能体提供视觉路由与像素级图像工具链,内置免费免 Key 视觉后备通道。
查看插件 →一款 DeepSeek Harness 视觉插件,可将粘贴的图片转换为结构化 OCR、版面和语义证据,供受支持的纯文本模型使用。
查看插件 →面向 DeepSeek Harness 的联网搜索插件,提供网页搜索、X 搜索和聚焦页面抓取,并返回结构化证据。
查看插件 →