DeepSeek Harness 报 maximum context length is 1048576 tokens:上下文窗口超限的原因与解决
DeepSeek Harness 报 maximum context length is 1048576 tokens,是上下文窗口超限:对话累积加上你请求的补全超出了模型的窗口上限(1048576 tokens 即 1M)。 触发时机是长会话、系统提示词过长、记忆与附件占额多。按「开新会话 → 清理记忆与附件 → 拆分长任务 → 调低 max_tokens」四步解决。
DeepSeek Harness 上下文超限报错原文与触发时机
报错原文为 maximum context length is 1048576 tokens——模型明确告诉你窗口上限是 1048576 tokens,你这次请求超了。 触发时机与判断(来源):
- 在长会话里继续发消息,对话历史 + 系统提示词 + 附件 + 请求的补全合计超限;
- 打开带大量附件的旧会话后发消息,附件按 token 计费、瞬间顶满窗口;
- 装了大量记忆类插件时,长期记忆被注入系统提示词,每次请求的固定开销变大;
- 判断关键:报错数字固定为 1048576,是模型窗口上限(DeepSeek 官方规格),不是配置坏了——减少占用即可。
DeepSeek Harness 窗口超限根因:会话累积 + 记忆与附件占额
窗口占用来自四块:历史对话、系统提示词、附件内容、请求的补全——长会话与记忆/附件插件是超限的两大元凶。 拆开算(来源):
- 历史对话累积:长会话每轮都带着全部历史重发,占额随轮次线性增长;
- 系统提示词过长:框架预设 + 插件注入的内容构成固定开销,提示词越长窗口越紧张;
- 附件占额:图片、文件按 token 计费,一张大图可能吃掉几千 token;
- 补全计入窗口:你请求的
max_tokens补全也占用窗口,调低它就能给输入留出空间; - 四块合计超过 1048576 tokens(1M 窗口上限,DeepSeek 官方规格)即报错。
解决 DeepSeek Harness 上下文超限:开新会话 → 清理记忆与附件 → 拆长任务 → 调低 max_tokens
按占用从大到小处理:先开新会话把累积清零,再清理记忆与附件,长任务拆段执行,最后调低 max_tokens 留余量。 逐步执行:
- 开新会话——长对话先让模型把要点总结成一段,把总结粘到新会话继续;新会话从零累积上下文,立即跳出超限(来源):
- 在会话列表点「新建会话」;
- 旧会话里执行「总结当前进度」类指令,复制摘要;
- 新会话第一句粘贴摘要,继续工作。
- 清理记忆与附件——临时禁用占用大的记忆插件(「设置 → 插件市场」里关闭),删除会话里不再需要的图片/文件消息;或开新会话时不带旧附件重发。
- 拆分长任务——把大任务拆成多个短会话分步执行:每步只带该步需要的上下文,做完一步再开下一步,比单次长对话更稳。
- 调低 max_tokens——在模型设置里降低 max_tokens(如从 8192 调到 4096),给输入上下文留出更多窗口:
- 打开「设置 → 模型」;
- 找到当前模型的 max_tokens 配置;
- 调低后重发消息,报错应消失。
DeepSeek Harness 上下文超限修复后怎么验证?重发测试与占用复盘
修完别急着继续工作——重发消息确认报错消失,再复盘一次窗口占用结构,避免下次再顶满。 按顺序执行:
-
重发原消息——回到刚才报错的会话,原样重发那条消息;不再报
maximum context length即占用已降下来。 -
在新会话里验证——开新会话粘贴总结后发一条测试消息,正常回复说明新会话从零累积、链路通畅。
-
复盘插件占用——列出当前 profile 的插件,确认记忆类插件是否还开着:
bashdsh plugin --profile web list在「设置 → 插件市场」禁用掉的记忆插件,不应再出现在活跃列表里;占用大头看清后,下次心里有数。
-
备选方案:换模型——同一任务确实需要更大上下文时,在「设置 → 模型」切到窗口更大的模型(各模型窗口规格见 DeepSeek 官方文档);窗口越大、单次请求可容纳的历史越多。
注意事项:DeepSeek Harness 上下文超限先开新会话
- 报错数字 1048576 是模型规格,不是故障——别去改配置文件里的「窗口大小」之类不存在的选项。
- 长会话先总结再新开,别硬顶窗口继续发——只会越占越多。
- 记忆类插件会长期占用窗口,装得多注意取舍;到 DSH Plugin Hub 插件市场挑记忆插件时,优先看插件说明里对上下文开销的说明。
- 其他安装报错可参考安装报错排查。

常见问题
DeepSeek Harness 报 maximum context length 是上下文窗口超限:对话加上你请求的补全超出了模型的上下文窗口(1048576 tokens 即 1M tokens 的窗口上限)。触发时机是长会话累积、系统提示词过长、或附件/图片占额多时发消息(来源)。
解决 DeepSeek Harness 对话超限先开新会话:把当前对话的重要结论手工搬过去,新会话从零累积上下文,立即跳出超限。长会话建议先让模型总结要点再新开,别硬顶窗口继续发消息。
会。DeepSeek Harness 里记忆类插件会把长期记忆注入系统提示词,附件(图片、文件)按 token 计费占额。清理方式:临时禁用记忆插件、删除会话里不再需要的附件消息,或开新会话不带旧附件重发。
调低 DeepSeek Harness 的 max_tokens 在模型设置里进行:给上下文留出更多余量(补全 token 也计入窗口);长任务拆成多个短会话分步执行,每步只保留该步需要的上下文,比单次长对话更稳(来源)。
相关术语
- 上下文窗口(context window)
- 上下文窗口是模型单次请求能处理的最大 token 数,包含历史对话、系统提示词、附件与请求的补全;DeepSeek 模型窗口上限为 1048576 tokens(1M)。— DeepSeek API 官方文档
- max_tokens
- max_tokens 是单次请求允许生成的最大 token 数,它与输入上下文共同计入窗口占用,调低它可给输入上下文留出更多空间。— DeepSeek API 官方文档
- token
- token 是模型处理文本的基本单位,中文约一个字对应 1-2 个 token;对话越长、附件越多,窗口占用越高。— DeepSeek API 官方文档
- 系统提示词(system prompt)
- 系统提示词是注入到每次请求开头的固定指令,包含框架与插件(如记忆插件)提供的内容,过长会显著挤占上下文窗口。— dshbase 常见问题排错
来源
- dshbase 常见问题排错(maximum context length 报错)· dshbase
- DeepSeek API 官方文档(模型上下文长度规格)· DeepSeek
- DeepSeek Harness llm-deepseek 适配器(max_tokens 与上下文校验逻辑)· deepseek-ai