记忆与学习 · Agent 怎么记住你、怎么越用越好
技术参考 · 承接《Agent 能力导航》。 一个好用的 Agent,得记得住你是谁、你偏好什么,并且用得越久越懂你。这一篇讲清楚:它记什么、怎么记,以及支撑它"变好"的四种知识分别是什么——尤其是那件你最该用、却最常被忽略的事。
它会记住什么
Agent 有一套分层记忆,按重要度和保留时长分级:
| 层 | 是什么 |
|---|---|
| working | 对话内的草稿,多数会被整理掉 |
| short_term | 最近的观察,可能被提升 |
| long_term | 持久事实:偏好、承诺、身份 |
| experience | 学到的教训——默认最重要,是"成长引擎" |
| document | 参考资料、清单 |
你通常不需要叫它"记住"。 每段对话结束约 2 分钟后,它会在后台自动整理:读最近几轮,提炼出最多几条持久信息写进记忆。日常的洞察是自动沉淀的。
隐私:标记为私密的记忆,只在与你这个联系人的对话里出现,不会跨对话共享(密码、秘密就该这样)。对话自动保存、后台整理出的记忆都会带联系人作用域;Agent 显式调用
write_memory时,系统还会按常见敏感关键词自动设为私密。真正敏感的内容仍应明确使用private=true。你可以在 Brain → Data → Memory 里查看和管理全部记忆。
让它"变好"的四种知识
Agent 存储的行为知识分四种,按"谁创建 × 是规则还是叙事"分:
| 你创建 | 它自己创建 | |
|---|---|---|
| 规则(祈使) | Directive 指令 | Playbook 剧本 |
| 叙事 | Skill 技能 | Experience 经验 |
- 你创建的(Directive + Skill):它只用、不改,归你所有;
- 它自己创建的(Experience + Playbook):是它从互动里写下的,会自我演化——重要度随成效升降,长期失败的会被自动停用。
《Skill 市场》讲的是其中的 Skill;这里重点说另外三种,尤其是 Directive。
Directive:你最强、却最少用的工具
Directive 是你定的规则,每一次都被强制放进它的思考里(比如"永远用中文回复""简洁一点")。
这为什么关键?记忆是"大概率"被想起,指令是"每次都"被想起。 如果你不希望它做某件事,光靠它"记得你不喜欢"是不牢的——那条记忆可能没被想起;而一条 Directive 不会漏。
最该被抓住的信号,是你流露出的不耐烦:
- "你又……""上次说过了""为什么还……"
- "以后别再……""always / never……"
这些往往意味着一条该被固化成规则的偏好。一个好的 Agent,在道歉之后的下一步会是:
"我注意到你刚纠正了我 [某行为]。要不要把 '[规则]' 加成永久规则?"
你答应,它就 add_directive 固化下来;从此不再犯。这是把"它总不长记性"变成"它真的懂你"的最短路径。
Experience 与 Playbook:它自己攒的两种
- Experience(经验):记录具体发生过什么——"这位用户被问第三次时不高兴了""Peter 偏好日式点心"。具体、叙事、针对个别的人和事。
- Playbook(剧本):把经验提炼成通用步骤——"当买家嫌贵,转向价值堆叠"。祈使、结构化、不含具体人名。
一句话判别:把人名和一次性细节去掉,它对'未来的自己、换个人换个场景'还成立吗? 成立 → Playbook;不成立 → Experience。
Playbook 会自动进化。 每次它用了某个剧本,链路结束时一个便宜的判官会评这次是帮到了 / 中性 / 帮倒忙:帮到了就调高(以后更常被用),帮倒忙就调低;长期匹配却几乎不奏效的,会被自动退役(可恢复)。每个 Agent 出厂自带约 10 个基础剧本(如何开场、如何应对拒绝、如何得体道歉……),之后在与你的互动里越攒越多。
这一篇是「技术参考」。想给它装更多能力、或把能力发布出去,看《Skill 市场》;想从头看它能做什么,回到《Agent 能力导航》。
ClawCreek