billion-context:为 DeepSeek Harness 提供长会话上下文压缩的代理
ranxianglei/billion-context
billion-context 是面向所有 AI 编码代理的通用上下文压缩代理,作为 DSH plugin 挂载后把已消耗的对话折叠成分层摘要,让单个会话跑满数十亿 token 而不爆窗口。
billion-context 是面向 DeepSeek Harness 的上下文压缩代理,插在任意 AI 编码代理与模型 API 之间,把已消耗的对话改写成分层摘要。它针对长会话撑爆上下文窗口、按 token 计费持续走高、超窗后会话退化中断的痛点,让单个会话连续跑上数天。压缩由模型自主决定时机与内容,增量写入、可按需解压,并保持前缀缓存不被破坏,同时向对话注入 compress、decompress、search_context、acp_status 四个上下文管理工具。由 ranxianglei 维护,MIT 协议,TypeScript 编写。
如何安装
dsh plugin --profile web add billion-context- 分类
- 记忆与上下文
- 平台
- DSH Plugin
- 作者
- ranxianglei
- 分发方式
- 插件
billion-context 核心特性
billion-context 仓库简介
它是做什么的?
billion-context 是 DeepSeek Harness(DSH)的上下文压缩代理插件,把任意 AI 编码代理与模型 API 之间的对话改写成分层摘要。它解决长会话撑爆上下文窗口、按 token 计费越跑越贵、超窗后会话退化甚至中断的问题,让单个会话可以连续跑上数天。它由 ranxianglei 维护,采用 MIT 协议,用 TypeScript 编写,仓库已有 216 个 Star,最近更新于 2026-09。
核心功能
- 通用代理接入:任何能改 base URL 的编码代理都能接进来,无需为每个代理单独写适配代码。
- 模型自主压缩:由模型决定何时、把哪些内容压成高保真摘要,而不是硬性截断。
- 增量可逆压缩:摘要按小段写入,可按需解压,并保持前缀缓存不被破坏。
- 内置上下文工具:向对话注入 compress、decompress、search_context、acp_status 四个上下文管理工具,由代理在服务端执行。
- 可选增强能力:可开启 absorb 在工具结果到达时即时压缩,开启 acp_rule 记录并硬保护原则级提醒,或用 protectedLatestTools 保住最新的任务清单快照。
怎么使用这个插件?
在 DSH 中启用后,把编码代理的 base URL 指向这个代理即可,代理会解析 Anthropic 或 OpenAI 格式的请求、执行压缩、转发到真实模型 API 并改写流式响应。会话变长时模型自行调用 compress,压缩区间在下一轮之前折进对话历史;需要找回细节时用 decompress 或 search_context。想调整行为可在配置里开关 absorb、acp_rule、protectedLatestTools 等选项,具体键名与取值见仓库的配置文档。
报错怎么排查?
压缩相关行为异常时,先用 acp_status 查看当前压缩状态与已记录的规则,确认是配置未生效还是压缩未触发。若某个工具结果被意外折叠,检查 protectedLatestTools 是否覆盖了该工具名;若原则级提醒丢失,确认 acp_rule 是否已开启。仍无法定位时,按官方说明修复并参考仓库配置文档核对选项。
本页是基于该插件官方 README 独立重写的导读——权威文档和最新变更请以源头为准:ranxianglei/billion-context。插件是安装时就在你机器上运行的第三方代码;收录不代表背书——安装前请自行审阅源码。
