DeepSeek Harness 插件
DeepSeek Harness 插件Manifest 有效

dsh-force-compact

面向 DeepSeek Harness 的激进上下文压缩插件,专为本地推理场景优化以保持常驻 prompt 精简高效。

视觉与图像UI 与效率开发者工具浏览器与 Web安全与策略
8GitHub Stars2Fork 数更新于2026-09-16

安装

$ dsh plugin --profile web add github:falling-ts/dsh-force-compact

插件能力与用途

基于公开仓库快照由 AI 辅助整理,内容必须有源码依据;它不等同于兼容性验证或安全验证。

源码有据
dsh-force-compact 是一个专为本地推理工作流打造的 DeepSeek Harness Cordis 插件。它通过双引擎(官方压缩服务或内置回退事务)实现会话历史的自动压缩。插件支持基于 token 预估阈值、回合结束(Turn End)以及手动斜杠命令触发压缩,在完整保留最近指定 token 历史的同时将早期历史归纳为单一摘要节点。此外,它支持针对自身摘要请求独立关闭思考模式(Thinking),有效降低自托管 llama.cpp 等本地端点的延迟与显存占用。

核心能力

  • 基于预估 token 阈值的请求前自动上下文压缩拦截
  • 智能体空闲(idle)时及 session/flush 持久化检查点的自动压缩
  • 支持通过 /force-compact 斜杠命令手动触发即时压缩
  • 双压缩引擎架构:优先调用官方 compaction 服务,无缝回退至内置持久化事务
  • 独立的作用域思考控制,仅对压缩总结调用关闭推理(支持 DeepSeek API 及 llama.cpp 原生字段)
  • Web 客户端 LiveUI 实时状态角标显示(压缩中/完成/运行中)
  • 集成设置面板,支持免重启实时热更新压缩阈值与参数

适用场景

  • 在通过 llama.cpp 自托管 Qwen 等本地模型时控制上下文长度与显存占用
  • 长周期多轮智能体对话中降低长上下文推理延迟
  • 完全本地化处理对话历史压缩,保障数据隐私与零 API 消耗

适合谁

  • 使用 DeepSeek Harness 接入自托管/本地大模型(如 llama.cpp)的开发者
  • 受限于硬件显存或上下文窗口限制的长会话重度用户

文档中可确认的限制

  • 设置参数存在硬性下限(如 autoThresholdTokens 最低 32000,retainLatestTokens 最低 8000)
  • /force-compact 命令采用延迟注册机制,需在会话产生首次模型请求后才在命令菜单中可用

DSH 兼容性

DSH Plugin 针对具体版本记录的运行验证证据。没有结果只代表我们尚未测试,不代表不兼容。

尚未测试目前还没有发布运行兼容性测试结果。

安全信号

来自包元数据和源码检查的客观信号。这些信息用于辅助判断,不代表绝对安全保证。

目前还没有发布自动安全检查信号。

来源与 Registry 记录

展示此条目的公开来源、Registry 分类与最近一次源码检查信息,并与运行验证结果明确分开。

源码仓库
falling-ts/dsh-force-compact
Registry 来源
GitHub · dsh-plugin topic
Registry 分类
Plugin
源码检查
15a5645 · 2026-09-20

本页面基于公开源码信息独立收录。DSH Plugin 与 DeepSeek 及插件作者均无隶属关系;安装前请始终以作者仓库中的最新说明为准。

仓库活跃度

GitHub Stars
8GitHub stars
Fork 数
2
未关闭 Issue
0
最近提交
2026-09-16
最近发布
未发现 Release
插件维护者

你在维护这个插件吗?

此条目根据公开仓库数据生成。如果你维护该项目,可以检查页面信息;如果你认为这个条目对用户有帮助,也可以在 README 或项目资源中引用它。

添加到 README
已收录于 DSHPlugin.app