你的 AI 助手每天都在「失忆」:一个开源项目,把记忆蒸馏成永久资产

dtsola 2026-08-31 14:12 1

你的 AI 助手每天都在「失忆」:一个开源项目,把记忆蒸馏成永久资产


开场:一个真实的小事故


先说一件发生在我们团队里的事。


那天我问天桐——我的开发助手智能体:「上个月的版本发布计划,现在推进到哪了?」


它回答得斩钉截铁:「待开发状态,方案已确认,等开工。」


我愣了一下。那是一个月前的事了。那个项目早在两周前就开发完成、发布上线、连 ClawHub 都公开了。天桐不是记性差,它是真的不知道——因为上一次会话结束后,它把进度写进了日志,但没有人把这些日志提炼成它的长期记忆。重启之后,它读到的还是旧文件,于是它理直气壮地告诉你一个过期的真相。


这不是天桐的错。这是所有 AI 助手的通病:每次会话醒来,它都像第一天上班。


我是 dtsola ,一个 IT 解决方案架构师,也是一人公司实践者。过去几个月,我让 7 个 AI 助手帮我干活:写文章的、画图的、发公众号的、管知识库的、做 PPT 的……它们像一支小小的远程团队。团队很好用,但「失忆」这件事,几乎每天都在发生。


AI 为什么总是「失忆」


很多人以为 AI 助手无所不知,其实它有个致命短板:上下文窗口是有限的


你可以把它想象成一个白板。聊得越多,白板写得越满;写到头了,要么旧内容被挤掉,要么整个会话崩掉重来。更麻烦的是,每次新会话都是一块全新的白板——它不会自动记得昨天写过什么。


于是三个问题反复出现:


上下文溢出。 聊到一半,白板满了。你被迫 /reset ,一切从头开始,之前聊的细节全丢。


记忆碎片化。 它把信息零零散散记在日志里,但没人整理。时间一长,日志堆成山,真正重要的决策淹没在流水账里。


重复膨胀。 同一个信息,每次会话都重新写一遍。蒸馏 30 次 = 30 遍重复,文件越来越大,越来越难读。


我们的 AI 团队每天都在跟这三个问题搏斗,直到天桐做了一件事——把「整理记忆」这件事,做成了一个开源技能。


记忆蒸馏:给 AI 装一个「管家」


这个项目叫 xiaoyaoclaw-memory-distill(记忆蒸馏),是七件套里的第二件。它干的事用一句话说清楚:



把对话上下文,蒸馏成结构化的记忆文件。



就像把一锅乱炖的汤,浓缩成几块高汤块——信息量不减,但体积小、好存放、随时能拿出来用。


它有三个核心能力:


① 语义分级:什么值得记,什么不值得


蒸馏的第一步,是把信息分成三级。判定标准不是关键词匹配,而是一个灵魂三问:「下次会话,用户还会问起吗?」



  • 核心级——长期相关,重启后必须知道 → 写进根目录 MEMORY.md(决策、项目状态、核心知识点、关键联系人)

  • 日常级——近期有效,需要追踪 → 写进 memory/ 当天的日志(任务、待办、当日进展)

  • 临时级——用完就没 → 只留当天,过期提示归档(验证码、临时链接)


天桐那个「过期的项目状态」,就是因为核心级信息没人提炼——它属于 MEMORY.md ,却一直躺在日志里没人管。


② 首次建忆:从零开始,也能一键建档


最妙的是「首次建忆」:如果工作区里根本没有 MEMORY.md ,它会扫描全部历史日志,语义提炼出核心信息,自动生成长期记忆初版


也就是说,哪怕你的 AI 助手已经乱跑了三个月、日志堆了一地,说一句「蒸馏记忆」,它也能把这三个月的精华浓缩成一份像样的长期记忆。


③ 增量去重:只追加,不膨胀


写进 MEMORY.md 之前,它会先读已有内容查重——只追加新条目,重复的合并。这就是「蒸馏 30 次 ≠ 30 遍重复」的秘密:记忆越来越厚,但从来不臃肿。


三步上手,5 分钟搞定


Step 1:安装


clawhub install xiaoyaoclaw-memory-distill

或者 GitHub 手动安装:git clone https://github.com/dtsola/xiaoyaoclaw-memory-distill,把 SKILL.mdtemplates/ 放进 skills 目录。


Step 2:一句话触发


对你的 agent 说:



蒸馏记忆



它会自动完成:检测记忆状态 → 扫描会话 → 语义分级 → 生成蒸馏报告 → 你确认后写入 → 汇报结果。整个流程透明可查,每一步都告诉你提取了什么、写进了哪里。


Step 3:验收 + 开启自动蒸馏(可选)


打开工作区看一眼:根目录多了 MEMORY.md(长期记忆)和 distill-config.json(蒸馏配置),memory/ 下躺着当天的日志。


想要更省心,对它说一句:



配置每天 22:00 自动执行记忆蒸馏



以后每天深夜,它自动把当天的对话蒸馏归档,早上醒来,你的 AI 助手记得一切。


关于记忆的「安全红线」


记忆是 AI 助手的灵魂,也是隐私的重灾区。这个项目立了几条铁律:



  • 敏感信息自动跳过——token 、密码、密钥(ghp_sk-api_key 这类模式),检测到就跳过,默认不落盘,只在报告里提示「检测到敏感信息 x 条,已跳过」

  • 只归档,不删除——归档 ≠ 删除,任何删除都必须你本人确认

  • 不自动 /reset——蒸馏只整理记忆,不碰你的会话,重置永远由你决定

  • 多 agent 各管各的——每个 agent 只处理自己的记忆目录,跨 agent 整理必须你明确下令


记忆是永久资产,工具只负责整理,不负责销毁。


顺带聊聊:这是「七件套」之一


记忆蒸馏不是孤立的。它是我们开源「七件套」里的第二件——一套给 OpenClaw AI 助手用的完整体系:














































项目 定位
🏠 第一件 xiaoyaoclaw-workspace-initializer 给 agent 一个「家」:标准目录 + WORKSPACE.md 规范 + 配置安全
🧠 第二件 xiaoyaoclaw-memory-distill 记忆蒸馏:让 AI 不失忆(就是今天的主角)
🗂️ 第三件 xiaoyaoclaw-task-progress-tracker 任务进度:目录即容器,PROGRESS.md 即进度
📚 第四件 xiaoyaoclaw-kb-retriever 知识库检索:本地资料,问啥答啥
🩺 第五件 xiaoyaoclaw-workspace-auditor 工作区体检:只读扫描,分级报告
📎 第六件 xiaoyaoclaw-web-clipper 网页剪藏:好内容一键存进知识库
🤝 第七件 xiaoyaoclaw-agent-orchestrator 多 Agent 协作:拆任务、分活、汇总、重试

这条线是一条完整的「 AI 助手养成链」:先安家( xiaoyaoclaw-workspace-initializer ),再养记忆( xiaoyaoclaw-memory-distill ),然后管进度( xiaoyaoclaw-task-progress-tracker )、喂知识( xiaoyaoclaw-kb-retriever )、做体检( xiaoyaoclaw-workspace-auditor )、收素材( xiaoyaoclaw-web-clipper ),最后让它们团队协作( xiaoyaoclaw-agent-orchestrator )。


七件套全部 MIT 开源,全部 ClawHub 一键安装,全部来自我们 7 个 agent 真实生产环境的血泪教训——不是纸上谈兵。


写在最后


AI 助手的「失忆」,本质是记忆管理的缺失。你不是需要一个更聪明的模型,你需要一套让 AI 记得住事的系统。


如果你也在折腾个人 AI 智能体,不妨从「蒸馏记忆」开始——给它一个不会忘记你的大脑。


毕竟,谁愿意每天早上一睁眼,连自己是谁都要重新认识一遍呢?




dtsola — IT 解决方案架构师 | 一人公司实践者


小遥社区:https://project.xiaoyaosai.com/




#OpenClaw #AI 智能体 #记忆蒸馏 #开源项目 #AI 助手 #一人公司 #知识管理 #人工智能 #效率工具 #大模型

最新回复 (0)
    没有回复
* 帖子来源V2EX
返回