名词解释 / 07
长短期记忆
英文名称:Long-Term and Short-Term Memory(缩写 LTM / STM) 常见别名:长期记忆与短期记忆、智能体记忆管理、分层记忆架构 所属分类:进一步了解 AI 原理
一句话解释
把 AI 的记性分成两层就很好懂:短期记忆是它当前这一轮对话里能看到的全部内容,容量有限、对话结束就清空,相当于一张工作台;长期记忆是保存在系统里、能跨对话反复调用的资料和偏好,相当于档案柜。两者配合,AI 智能体和办公 AI 才不会在长对话和长期使用中“失忆”。
工作中什么时候会遇到
平时用千问办公、WorkBuddy 这类办公 AI 时,你其实经常碰到它。上午让它按你的习惯整理一份供应商比价,下午接着同一个话题问,它还记得你要的字段和上次的结论;甚至你交代过一次“周报固定用表格”,之后它每次都照做——这就是长期记忆在起作用。
反过来,当一段对话拉得很长,来回几十轮,或者你一次贴进大量资料时,你会发现它开始答非所问,或者把最早交代的硬性要求(比如“报价必须不含税”)弄错。这通常是短期记忆“满了”:单次能处理的内容有限,最靠前的细节被一点一点挤了出去。
能解决什么问题
- 省掉重复交代背景:公司、岗位、常用格式等信息被记住后,不用每次从头说一遍。
- 跨天、跨会话接续工作:上午没做完的事,下午或第二天开新对话还能接上。
- 长对话中保持前后一致:通过筛选、总结和压缩,让 AI 始终抓住最初的目标,不跑偏。
- 让回答更贴合你的情况:结合你或部门的历史偏好输出,而不是每次都从零猜。
- 给“容量有限”兜底:对话太长时,用长期记忆补回被挤掉的关键信息。
举个例子
某设备企业的客服专员每天用办公 AI 整理客户质量投诉。第一次使用时她交代:“我是客服岗,投诉周报固定按‘产品型号、问题描述、处理进度、是否涉及批次异常’四段写,涉及批量问题的单独标出来。”这条偏好被存进长期记忆,之后她每次只说一句“出周报”,AI 都会按这个框架生成。
一次她要把一整周的投诉做汇总,把几十条记录一次性贴进了对话框。聊到后面她问“这周哪些型号出现过重复投诉”,AI 漏掉了最早贴进去的几条——因为单轮能处理的内容有限,最靠前的细节被挤出了短期记忆。她把那几条记录重新发了一遍,AI 才给全名单。人工确认点:“哪些型号要重点排查”是要进周报、上生产例会的判断,即便 AI 给了名单,仍要对照原始投诉台账逐条复核,不能只凭它的“记得”。
怎么使用
普通员工能做两件事。一是主动“喂”长期记忆:把固定偏好和要求用明确的话交代清楚,例如“我负责采购,比价前先核对规格和交期”“以后报价单都用这个模板”,具备记忆能力的办公 AI 会把这类指令性信息沉淀下来。二是管好短期记忆:对话变长时,先让 AI 总结当前进度再继续,或者开新对话时贴一句关键背景,降低它因内容过长而丢细节的概率。
企业级的长期记忆——员工档案、客户资料、产品知识库等——通常由管理员统一配置和维护,普通员工不直接改动,只需知道:重要资料如果在知识库里,对话时点名让 AI 去查即可。至于哪些内容会被记住、保存多久、能否手动删除,各产品做法不同,以当前版本和官方说明为准。
使用时要注意什么
记忆不等于可靠记录。长期记忆里的内容由 AI 自己归纳整理,可能记错、记混,把相似客户或相似要求搞混;重要结论要回原始文件或台账核对,不能只靠它“记得”。短期记忆有硬性容量,超长对话里任何产品都可能丢细节,所以关键要求最好在对话里留下可复查的文字。
还要留意隐私边界:被记住的内容可能在之后的会话里被再次调用,“说完就忘”并不成立。薪酬、客户隐私等敏感信息按公司数据管理规定处理,涉及删除、对外发送等敏感操作,以系统设置的人工确认为准。
容易混淆的词
- LSTM(长短期记忆网络):名字像,其实是两回事。LSTM 是早期人工智能研究里处理时间序列数据的一种网络结构,属于技术发展史上的概念;本词条讲的是智能体的记忆分层管理。普通职场读者基本碰不到前者,见到时别当成一回事。
- 上下文窗口:指 AI 单次能处理的全部内容上限,可以理解为短期记忆的“物理容量”。短期记忆管理,就是在这个容量里做筛选、总结、压缩,让重要内容留下来。
- 知识库:企业预先整理好的参考资料,如制度、产品手册、常见问题。它需要被检索调用才起作用;记忆则是 AI 在对话中主动沉淀和调用的东西。知识库更像外部资料,记忆是它的内部积累,两者常被混为一谈。
- 聊天记录存档:把对话原文原样存下来,不等于长期记忆。长期记忆要经过整理、去重、能按需检索,才算真正被复用;原文存档只是“放着”。