DeepSeek Harness 插件
DeepSeek Harness 插件Manifest 有效

dsh-autovision

为 DeepSeek Harness Web 中的纯文本模型提供自动图片转写能力,使用用户配置的多模态模型处理图片。

视觉与图像UI 与效率开发者工具
1GitHub Stars0Fork 数更新于2026-08-18

安装

$ dsh plugin --profile web add @iroam2375/dsh-autovision

插件能力与用途

基于公开仓库快照由 AI 辅助整理,内容必须有源码依据;它不等同于兼容性验证或安全验证。

源码有据
dsh-autovision 是一个 DeepSeek Harness Web 插件,通过运行时孪生适配器为纯文本模型处理含图片的请求。它使用用户配置的视觉模型将图片转写为文本,再交给原始文本模型;同时提供可由 Agent 调用的读图工具。

核心能力

  • 在运行时为纯文本模型注册支持图片输入的孪生适配器。
  • 自动将含图片的 Agent 请求重定向到对应的孪生适配器。
  • 通过配置的多模态模型转写粘贴图片内容,并将结果作为文本注入。
  • 提供可由 Agent 调用的 autovision_read_image 工具,可按任务指令读取图片文件。
  • 支持可选的 Provider 白名单和自定义视觉提示词。
  • 使用 LRU 缓存保存图片转写结果。

适用场景

  • 在使用纯文本 DeepSeek 或 GLM 模型的会话中粘贴截图或图片。
  • 让 Agent 在任务执行期间检查图片文件。
  • 保持文本模型工作流,同时将图像识别交给已配置的多模态模型。
  • 从附件图片中提取可见文字或描述 UI 状态。

适合谁

  • 同时配置了纯文本模型和多模态模型的 DeepSeek Harness Web 用户。
  • 需要在不修改模型配置的情况下实现图片转文本桥接的 Agent 与开发者。
  • 希望避免内置 API 密钥或第三方中继服务的用户。

文档中可确认的限制

  • 需要 dsh web 0.1.0-rc.6 或更高版本。
  • 需要用户配置默认的多模态视觉模型。
  • 新会话的第一条消息若包含图片会被静默跳过;需先发送一条文本消息。
  • 图片大小受附件本地默认限制,为 5 MB。
  • 转写延迟取决于所选视觉模型。
  • 设置页面可能显示一条没有地址的裸 autovision Provider 行;这只是外观问题。

DSH 兼容性

DSH Plugin 针对具体版本记录的运行验证证据。没有结果只代表我们尚未测试,不代表不兼容。

尚未测试目前还没有发布运行兼容性测试结果。

安全信号

来自包元数据和源码检查的客观信号。这些信息用于辅助判断,不代表绝对安全保证。

依赖数量

package.json 声明了 0 个运行依赖、0 个开发依赖、0 个 Peer 依赖和 0 个可选依赖。

信息
已声明 DSH Bundle

package.json 中声明了 DSH Bundle 元数据。

信息
已声明许可证

GitHub 报告该仓库许可证为 MIT。

信息
已获取 package.json

已获取仓库根目录 package.json,可用于 Registry 元数据检查。

信息
源码可用

本次 Registry 快照已获取公开 GitHub 源码元数据。

信息

来源与 Registry 记录

展示此条目的公开来源、Registry 分类与最近一次源码检查信息,并与运行验证结果明确分开。

源码仓库
Junkrat9527/dsh-autovision
Registry 来源
GitHub · dsh-plugin topic
Registry 分类
Plugin
源码检查
d6e9b13 · 2026-08-25

本页面基于公开源码信息独立收录。DSH Plugin 与 DeepSeek 及插件作者均无隶属关系;安装前请始终以作者仓库中的最新说明为准。

仓库活跃度

GitHub Stars
1GitHub stars
Fork 数
0
未关闭 Issue
1
最近提交
2026-08-18
最近发布
未发现 Release
插件维护者

你在维护这个插件吗?

此条目根据公开仓库数据生成。如果你维护该项目,可以检查页面信息;如果你认为这个条目对用户有帮助,也可以在 README 或项目资源中引用它。

添加到 README
已收录于 DSHPlugin.app