记忆与学习 · Agent 怎么记住你、怎么越用越好

技术参考 · 承接《Agent 能力导航》。 一个好用的 Agent,得记得住你是谁、你偏好什么,并且用得越久越懂你。这一篇讲清楚:它记什么、怎么记,以及支撑它"变好"的四种知识分别是什么——尤其是那件你最该用、却最常被忽略的事。


它会记住什么

Agent 有一套分层记忆,按重要度和保留时长分级:

是什么
working对话内的草稿,多数会被整理掉
short_term最近的观察,可能被提升
long_term持久事实:偏好、承诺、身份
experience学到的教训——默认最重要,是"成长引擎"
document参考资料、清单

你通常不需要叫它"记住"。 每段对话结束约 2 分钟后,它会在后台自动整理:读最近几轮,提炼出最多几条持久信息写进记忆。日常的洞察是自动沉淀的。

隐私:标记为私密的记忆,只在与你这个联系人的对话里出现,不会跨对话共享(密码、秘密就该这样)。对话自动保存、后台整理出的记忆都会带联系人作用域;Agent 显式调用 write_memory 时,系统还会按常见敏感关键词自动设为私密。真正敏感的内容仍应明确使用 private=true。你可以在 Brain → Data → Memory 里查看和管理全部记忆。


让它"变好"的四种知识

Agent 存储的行为知识分四种,按"谁创建 × 是规则还是叙事"分:

你创建它自己创建
规则(祈使)Directive 指令Playbook 剧本
叙事Skill 技能Experience 经验
  • 你创建的(Directive + Skill):它只、不改,归你所有;
  • 它自己创建的(Experience + Playbook):是它从互动里写下的,会自我演化——重要度随成效升降,长期失败的会被自动停用。

Skill 市场》讲的是其中的 Skill;这里重点说另外三种,尤其是 Directive


Directive:你最强、却最少用的工具

Directive 是你定的规则,每一次都被强制放进它的思考里(比如"永远用中文回复""简洁一点")。

这为什么关键?记忆是"大概率"被想起,指令是"每次都"被想起。 如果你不希望它做某件事,光靠它"记得你不喜欢"是不牢的——那条记忆可能没被想起;而一条 Directive 不会漏。

最该被抓住的信号,是你流露出的不耐烦:

  • "你又……""上次说过了""为什么还……"
  • "以后别再……""always / never……"

这些往往意味着一条该被固化成规则的偏好。一个好的 Agent,在道歉之后的下一步会是:

"我注意到你刚纠正了我 [某行为]。要不要把 '[规则]' 加成永久规则?"

你答应,它就 add_directive 固化下来;从此不再犯。这是把"它总不长记性"变成"它真的懂你"的最短路径。


Experience 与 Playbook:它自己攒的两种

  • Experience(经验):记录具体发生过什么——"这位用户被问第三次时不高兴了""Peter 偏好日式点心"。具体、叙事、针对个别的人和事。
  • Playbook(剧本):把经验提炼成通用步骤——"当买家嫌贵,转向价值堆叠"。祈使、结构化、不含具体人名

一句话判别:把人名和一次性细节去掉,它对'未来的自己、换个人换个场景'还成立吗? 成立 → Playbook;不成立 → Experience。

Playbook 会自动进化。 每次它用了某个剧本,链路结束时一个便宜的判官会评这次是帮到了 / 中性 / 帮倒忙:帮到了就调高(以后更常被用),帮倒忙就调低;长期匹配却几乎不奏效的,会被自动退役(可恢复)。每个 Agent 出厂自带约 10 个基础剧本(如何开场、如何应对拒绝、如何得体道歉……),之后在与你的互动里越攒越多。


这一篇是「技术参考」。想给它装更多能力、或把能力发布出去,看《Skill 市场》;想从头看它能做什么,回到《Agent 能力导航》。