billion-context:为 DeepSeek Harness 提供长会话上下文压缩的代理

ranxianglei/billion-context

记忆与上下文已验证
收录时间 2026-09-21
页面最后更新 2026-10-04

billion-context 是面向所有 AI 编码代理的通用上下文压缩代理,作为 DSH plugin 挂载后把已消耗的对话折叠成分层摘要,让单个会话跑满数十亿 token 而不爆窗口。

billion-context 是面向 DeepSeek Harness 的上下文压缩代理,插在任意 AI 编码代理与模型 API 之间,把已消耗的对话改写成分层摘要。它针对长会话撑爆上下文窗口、按 token 计费持续走高、超窗后会话退化中断的痛点,让单个会话连续跑上数天。压缩由模型自主决定时机与内容,增量写入、可按需解压,并保持前缀缓存不被破坏,同时向对话注入 compress、decompress、search_context、acp_status 四个上下文管理工具。由 ranxianglei 维护,MIT 协议,TypeScript 编写。

如何安装

install
npmdsh plugin --profile web add billion-context
分类
记忆与上下文
平台
DSH Plugin
作者
ranxianglei
分发方式
插件

billion-context 核心特性

代理层压缩上下文分层摘要可解压回读注入 compress 等工具兼容 Anthropic/OpenAI
Listed on dsh-plugin.org

billion-context 仓库简介

它是做什么的?

billion-context 是 DeepSeek Harness(DSH)的上下文压缩代理插件,把任意 AI 编码代理与模型 API 之间的对话改写成分层摘要。它解决长会话撑爆上下文窗口、按 token 计费越跑越贵、超窗后会话退化甚至中断的问题,让单个会话可以连续跑上数天。它由 ranxianglei 维护,采用 MIT 协议,用 TypeScript 编写,仓库已有 216 个 Star,最近更新于 2026-09。

核心功能

  • 通用代理接入:任何能改 base URL 的编码代理都能接进来,无需为每个代理单独写适配代码。
  • 模型自主压缩:由模型决定何时、把哪些内容压成高保真摘要,而不是硬性截断。
  • 增量可逆压缩:摘要按小段写入,可按需解压,并保持前缀缓存不被破坏。
  • 内置上下文工具:向对话注入 compress、decompress、search_context、acp_status 四个上下文管理工具,由代理在服务端执行。
  • 可选增强能力:可开启 absorb 在工具结果到达时即时压缩,开启 acp_rule 记录并硬保护原则级提醒,或用 protectedLatestTools 保住最新的任务清单快照。

怎么使用这个插件?

在 DSH 中启用后,把编码代理的 base URL 指向这个代理即可,代理会解析 Anthropic 或 OpenAI 格式的请求、执行压缩、转发到真实模型 API 并改写流式响应。会话变长时模型自行调用 compress,压缩区间在下一轮之前折进对话历史;需要找回细节时用 decompress 或 search_context。想调整行为可在配置里开关 absorb、acp_rule、protectedLatestTools 等选项,具体键名与取值见仓库的配置文档。

报错怎么排查?

压缩相关行为异常时,先用 acp_status 查看当前压缩状态与已记录的规则,确认是配置未生效还是压缩未触发。若某个工具结果被意外折叠,检查 protectedLatestTools 是否覆盖了该工具名;若原则级提醒丢失,确认 acp_rule 是否已开启。仍无法定位时,按官方说明修复并参考仓库配置文档核对选项。

本页是基于该插件官方 README 独立重写的导读——权威文档和最新变更请以源头为准:ranxianglei/billion-context。插件是安装时就在你机器上运行的第三方代码;收录不代表背书——安装前请自行审阅源码。

安装、更新、卸载这个插件,都在 DeepSeek Harness 的 DSH Plugin Hub 插件市场完成

DSH Plugin 常见问题