这是什么

字节开源框架 DeerFlow 拆开 Agent 长期记忆的实现,结论反直觉:默认根本不用向量数据库(一种按语义相似度检索的数据库)——LLM 提议、代码拍板,简单做法反而更稳。

它的 Memory 设计分三步:

  • 过滤:剔除工具调用、确认语(「好的」「谢谢」)、临时文件等明显没价值的消息;
  • 提议:一个专门的 Memory LLM 评估「这条值不值得记」,输出结构化事实;
  • 裁决:代码层校验——必须是用户级、长期有效、置信度≥0.7,才真正落盘。

设计上还引入 debounce(去抖,用户暂停输入后才触发)和 watermark(已处理位置标记),控制重复调用。

行业怎么看

支持者认为,这才是 Agent 产品化的真正分水岭:用户感受到的「懂不懂我」,核心在记忆质量,而非模型大小。精细化的过滤和裁决,把通用模型变成私人助手。

质疑同样存在:JSON 文件存储意味着换设备即丢失,跨端同步是大坑;每轮对话额外调用 Memory LLM,延迟与成本不能忽视;更重要的是,单人场景能 work,企业 1000 人并发时,事实冲突怎么仲裁、隐私边界怎么划,目前都没有答案。也有声音指出,DeerFlow 展示的是思路而非终态——当 Agent 进入企业核心流程,记忆系统复杂度会再上一个台阶。

对普通人的影响

对企业 IT:评估 AI 助手时,「它记得住我吗」会和「它聪明吗」一样重要。选型清单上该多一项:长期记忆机制。

对个人职场:未来你日常用的 AI 工具,会越来越分化为「懂你的」和「不懂你的」两类——差别往往不在模型,而在背后那套记忆设计。

对消费市场:AI 陪伴、助理类产品会进一步分化。会记的产品粘性更高,但用户对数据归属和「被遗忘权」的诉求也会更强。