mnemon 是什么?给 AI 代理 LLM 监督的跨会话持久记忆
mnemon 是 DeepSeek Harness(DSH Plugin)生态中的 LLM 监督型持久记忆插件,让 AI 代理跨会话记住关键决策:它用单一本地二进制 + 零 API 密钥,把记忆沉淀为四图知识存储,并在需要时按意图召回。 本文基于官方 README 介绍它是什么、核心功能、安装启用、典型用法与常见排错。
mnemon 是什么?
mnemon 解决「AI 代理会话之间全忘」的问题:上下文压缩丢掉关键决策、跨会话知识消失、长对话把早期信息挤出窗口——它用宿主 LLM 监督 + 独立二进制的模式,提供持久的跨会话记忆。 以下定位与事实均来自官方 README(来源):
mnemon 由 mnemon-dev 用 Go 开发、以 Apache-2.0 协议开源,定位是「LLM 监督的 AI 代理持久记忆」。它的思路与多数记忆工具不同:宿主 LLM 是监督者(判断该记住什么、怎么关联、何时遗忘),二进制负责确定性计算(存储、图索引、搜索、衰减),没有内嵌 LLM、没有中间商推理成本。记忆命令路径 mnemon 是一个本地二进制,一条 setup 命令即可接入。它还用一个「意图原生协议」填补协议栈空白:remember、link、recall 三个原语把命令名映射到 LLM 的认知词汇,输出结构化 JSON 而非原始数据库行。DeepSeek Harness 通过 dsh-mnemon 插件集成,把 DSH 运行时记忆、托管项目文档与 Mnemon 长期记忆空间合成一套受监督的三层记忆系统。
mnemon 的核心功能有哪些?
mnemon 的核心能力是「四图知识存储、意图感知召回、重要性衰减与自动去重、零用户侧操作、多框架支持」:让代理的记忆像复利一样随使用增值。 这些能力全部来自官方 README(来源):
- 四图知识存储:时间、实体、因果、语义四类边构成知识图谱,不只是向量相似度;真实示例图谱含 87 条洞察、2150 条边。
- 意图感知召回:图遍历 + 可选向量搜索(RRF 融合),默认对所有查询开启;召回读取的是活动记忆空间。
- 内置去重与保留生命周期:
remember自动检测重复与冲突(跳过或自动替换);重要性衰减、访问计数加权与垃圾回收管理保留。 - LLM 监督模式:宿主 LLM 做判断(记什么、怎么关联、何时忘),二进制做确定性计算;无需额外 API 密钥,Claude 订阅即智能层。
- 意图原生协议:
remember/link/recall三个原语,输出结构化 JSON,信号透明,无需数据库命令。 - 零用户侧操作:装一次即可;支持的运行时用钩子或插件,最小运行时用持久规则;隐私安全的收据可导出哈希操作凭据,用于记忆边界审计。
怎么安装与启用 mnemon?
在 DeepSeek Harness 里启用 mnemon 需要两步:先在主机安装 mnemon 二进制,再安装 dsh-mnemon 插件并重启 Web profile。 安装命令来自官方 README(来源):
1. 安装 mnemon 二进制:macOS 用 Homebrew Cask,其他平台用 Go install:
brew install --cask mnemon-dev/tap/mnemon
2. 添加 dsh-mnemon 插件:在 DSH 终端执行安装命令(新装会解析 npm 上的 dsh-mnemon latest 版):
dsh plugin --profile web add dsh-mnemon
3. 启动并启用:重启 Web profile,然后在「设置 → 插件配置 → Mnemon」选择存储范围,在会话的 Memory System 标签创建或激活记忆空间:
dsh --profile web
4. 更新 / 卸载:更新重跑安装命令;卸载时移除插件,主机侧用 mnemon setup --eject 移除全部集成:
dsh plugin --profile web update dsh-mnemon
dsh plugin remove dsh-mnemon
安装后验证:mnemon --version 确认二进制可用;DSH 设置页确认插件已启用。记忆数据默认位于 ~/.mnemon(可用 MNEMON_DATA_DIR 修改)。
mnemon 典型用法
mnemon 的日常使用几乎不需要你亲自敲命令——钩子在会话开始、提问、回答后与压缩前四个边界自动提醒代理;需要隔离或查看时用存储命令。 以下用法来自官方 README(来源):
1. 为不同项目隔离记忆:默认所有会话共享 default 存储,用命名存储隔离:
mnemon store create work
mnemon store set work
2. 激活记忆空间:在 DSH 会话的 Memory System 标签创建或激活空间,召回只读取活动空间,持久写入走受监督子代理。
3. 查看嵌入状态:嵌入是可选的,未配置时纯图遍历也够用;配置后检查状态:
mnemon embed --status
4. 配置本地嵌入:默认 Ollama(localhost:11434),也可用 OpenAI 兼容端点:
export MNEMON_EMBED_ENDPOINT=http://127.0.0.1:18000/v1
export MNEMON_EMBED_MODEL=bge-m3-mlx-8bit
export MNEMON_EMBED_API_KEY=sk-...
四个钩子阶段:Prime(让技能、指南、活动存储可见)、Remind(判断召回是否可能改变任务)、Nudge(判断是否值得写回)、Compact(压缩前只保留关键连续性)——它们是提醒,不是硬性工作流。
mnemon 常见问题与排错
mnemon 的常见问题集中在「装了没记忆」「直接 GitHub 源安装报错」「Windows 缺功能」「向量召回差」四类,下面给出症状、原因与解决步骤。 排错依据来自官方 README(来源):
1. 症状:新会话召回到旧记忆。 原因:mnemon 二进制未装、存储范围未选、记忆空间未激活。解决:确认主机已装二进制(mnemon --version),在 DSH「设置 → 插件配置 → Mnemon」选择存储范围,在会话 Memory System 标签激活空间;召回只读活动空间。
2. 症状:直接 add github:mnemon-dev/mnemon 装不上或行为异常。 原因:新安装会解析 npm 的 dsh-mnemon latest 版,源码源路径不稳定。解决:改用 npm 通道:
dsh plugin --profile web add dsh-mnemon
3. 症状:Windows 上 Agency 功能缺失。 原因:Agency 预览需要在本地权限边界获得原生 Windows 安全支持后才能用。解决:Windows 只支持核心 Memory 命令,记忆功能不受影响;Agency 待原生支持后再启用。
4. 症状:语义召回命中不理想。 原因:未配置嵌入(可选),只走图遍历。解决:配置 Ollama 或 OpenAI 兼容嵌入端点后重启(见「典型用法」),用 mnemon embed --status 确认状态。
适用场景与注意
mnemon 适合「跨框架、跨会话都需要长期记忆」的 AI 代理工作流,特别是已经订阅 Claude 的 DeepSeek Harness 用户;零密钥、单一二进制让它部署成本极低。 事实来自官方 README(来源):
适用场景:多会话项目要记住关键决策;Claude Code、Codex、Cursor、TRAE 等多个运行时共享一份记忆(愿景是全部本地代理共享 ~/.mnemon 一处活跃记忆);上下文压缩频繁、关键信息易丢的工作流。
注意与限制:
- Windows 不支持 Agency 预览(核心 Memory 命令可用);
- 嵌入是可选的,纯图遍历已够用;需要向量混合检索时再配置嵌入端点;
- 记忆数据默认在本机
~/.mnemon,是随用户增长的私有资产; - 与内嵌 LLM 的记忆工具相比,mnemon 采用 LLM 监督模式,不内嵌 LLM、无额外推理成本。
项目链接
mnemon 是 mnemon-dev 维护的 Apache-2.0 开源项目,当前版本 v0.2.5。
前往插件详情页查看完整信息:mnemon。
本页是基于该插件官方 README 独立重写的导读——权威文档和最新变更请以源头为准:mnemon-dev/mnemon。插件是安装时就在你机器上运行的第三方代码;收录不代表背书——安装前请自行审阅源码。
常见问题
启用后运行 mnemon setup 自动检测并配置 Claude Code,或用 mnemon agency setup 启用 Agency 预览;完成后新会话记忆自动生效,无需额外操作。
Mnemon 三原语构成意图原生协议:remember 存新知识,link 建关联,recall 按意图召回;输出结构化 JSON,让 LLM 以认知词汇而非数据库命令操作记忆。
Mnemon 在 Windows 上支持核心 Memory 命令,但 Agency 预览需原生 Windows 安全支持;此前仅记忆功能可用,无项目级责任与效果准入功能。
Mnemon 的二进制负责确定性计算,包括存储、图索引、搜索与衰减;重要性衰减让旧记忆随时间降低权重,自动去重消除冗余知识,LLM 作为外部监督者判断何时遗忘,二进制执行衰减与去重。
不需要。Mnemon 完全通过现有 Claude 订阅工作,无需额外 API 密钥;你的 LLM 订阅就是智能层,二进制只做确定性计算,因此没有中间商推理成本,只需两条命令即可完成设置。
Mnemon 的 remember、link、recall 原语构成意图原生协议,输出 JSON 而非数据库行,填补协议栈空白;MCP 仅标准化工具调用方式,缺少记忆语义层。
相关术语
- mnemon
- mnemon 是 LLM 监督的 AI 代理持久记忆程序,用单一本地二进制提供跨会话记忆,宿主 LLM 判断记什么、何时忘,二进制负责存储、图索引、搜索与衰减。— mnemon README
- LLM 监督模式
- LLM 监督模式是 mnemon 的核心架构:宿主 LLM 作为外部监督者做判断,独立二进制做确定性计算,不内嵌 LLM、不需要额外 API 密钥、无中间商推理成本。— mnemon README
- 意图原生协议
- 意图原生协议是 mnemon 的 memory/link/recall 三个原语构成的记忆语义层,命令名映射到 LLM 的认知词汇,输出结构化 JSON,填补 MCP 与数据库之间的协议空白。— mnemon README
- 四图知识存储
- 四图知识存储是 mnemon 的记忆结构,用时间、实体、因果、语义四类边组织知识图谱,而不只是向量相似度,配合意图感知召回实现精准检索。— mnemon README
来源
- mnemon-dev/mnemon GitHub repository· GitHub
- mnemon README· GitHub