LangChain Memory 记忆系统:让 AI 记住对话的魔法
引言为什么 AI 需要“记忆”在与 ChatGPT 等大模型对话时你是否曾感到一丝“挫败”你刚刚在上一轮对话中详细说明了需求下一轮它却仿佛失忆般问道“您能再详细描述一下吗” 这种“金鱼式”的七秒记忆正是早期 AI 应用在构建多轮对话或复杂任务流程时面临的核心挑战。LangChain Memory记忆系统正是为解决这一问题而生的核心组件。它如同一个智能的“对话笔记本”能够跨越多次交互持久化、选择性地存储和检索用户与模型之间的历史信息让 AI 应用真正拥有“上下文感知”的能力。无论是构建一个贴心的客服机器人、一个持续学习的编程助手还是一个能记住你偏好的个性化应用Memory 都是不可或缺的基石。本文将带你深入 LangChain Memory 的世界从核心概念到实战应用手把手教你如何为你的 AI 应用注入“记忆”的魔法。1. 理解 Memory核心概念与工作原理1.1 什么是 Memory在 LangChain 框架中Memory是一个用于在链Chain或智能体Agent的多次调用之间持久化状态的模块。这里的“状态”通常指代对话历史、用户偏好、会话变量等上下文信息。简单来说Memory 做了两件事存储在每次对话或交互后将重要的信息如用户查询、AI 回复、提取的实体等保存起来。检索在后续的交互中根据当前查询从存储中提取相关的历史信息并将其作为上下文注入到给大模型的提示Prompt中。1.2 Memory 的核心组件一个典型的 Memory 模块包含以下几个关键部分Memory Variables定义了需要存储和读取的变量名。最常见的两个是chat_history存储完整的对话记录列表。input存储最近一次的用户输入有时用于短期上下文。LLM大型语言模型本身。某些复杂的 Memory 类型如ConversationSummaryMemory需要 LLM 来总结或提炼历史。Retriever决定如何从存储中查找相关信息的组件。可以是简单的“返回全部”也可以是基于向量相似度的语义检索。Backing Store底层的数据存储可以是内存BufferMemory、数据库、文件系统等。1.3 工作原理流程图渲染错误:Mermaid 渲染失败: Parse error on line 4: ... A1[“用户输入(Query)”] -- A2[“Me -----------------------^ Expecting SQE, DOUBLECIRCLEEND, PE, -), STADIUMEND, SUBROUTINEEND, PIPE, CYLINDEREND, DIAMOND_STOP, TAGEND, TRAPEND, INVTRAPEND, UNICODE_TEXT, TEXT, TAGSTART, got PS2. LangChain 内置 Memory 类型详解LangChain 提供了多种开箱即用的 Memory 类适用于不同场景。2.1 ConversationBufferMemory最基础、最常用的记忆类型。它将完整的对话历史以字符串或消息列表的形式保存在内存缓冲区中。特点优点简单直接保留所有原始信息。缺点当对话轮次增多时Prompt 会急剧膨胀可能触及模型上下文长度限制且成本增加。代码示例fromlangchain.memoryimportConversationBufferMemoryfromlangchain_openaiimportChatOpenAIfromlangchain.chainsimportConversationChain# 初始化 Memory 和 LLMmemoryConversationBufferMemory()llmChatOpenAI(modelgpt-3.5-turbo,temperature0)# 创建对话链conversationConversationChain(llmllm,memorymemory,verboseTrue)# 进行多轮对话response1conversation.predict(input你好我叫小明。)print(response1)# 输出: 你好小明很高兴认识你。response2conversation.predict(input你还记得我的名字吗)print(response2)# 输出: 当然记得你刚才说你叫小明。2.2 ConversationBufferWindowMemoryConversationBufferMemory的升级版它只保留最近k轮对话。特点优点有效控制上下文长度避免无限增长。缺点会“遗忘”超出窗口的早期重要信息。代码示例fromlangchain.memoryimportConversationBufferWindowMemory# 只保留最近2轮对话memoryConversationBufferWindowMemory(k2)# ... 后续使用同上2.3 ConversationSummaryMemory一种更高级的记忆方式。它并不存储完整的对话原文而是利用 LLM 对之前的对话历史进行总结只将总结文本存入记忆。在新的交互中将最新的总结和当前问题一起交给 LLM。特点优点极大地压缩了上下文长度能保留长期对话的“精髓”。缺点总结过程会产生额外的 LLM 调用和成本可能存在信息损失。代码示例fromlangchain.memoryimportConversationSummaryMemoryfromlangchain_openaiimportChatOpenAI llmChatOpenAI(modelgpt-3.5-turbo)memoryConversationSummaryMemory(llmllm)# ... 后续使用同上2.4 ConversationSummaryBufferMemory结合了Buffer和Summary的优点。它维护一个固定长度的缓冲区当对话长度超过阈值时将最早的对话进行总结同时保留较新的原始对话。特点在控制长度和保留细节之间取得了较好的平衡。2.5 其他实用 Memory 类型ConversationEntityMemory专注于识别和记忆对话中提到的实体如人名、地点、产品并建立实体之间的关系。ConversationKnowledgeGraphMemory将对话信息以知识图谱的形式存储支持更复杂的关联查询。VectorStoreRetrieverMemory将对话历史存入向量数据库如 Chroma, Pinecone每次通过语义检索召回最相关的片段非常适合超长对话。3. 实战构建一个能记住上下文的聊天机器人让我们构建一个完整的、使用 Memory 的聊天机器人应用。3.1 项目初始化与环境准备# 创建项目目录并安装依赖mkdirlangchain-memory-botcdlangchain-memory-bot pipinstalllangchain langchain-openai python-dotenv在项目根目录创建.env文件填入你的 OpenAI API KeyOPENAI_API_KEYyour_api_key_here3.2 核心代码实现创建app.pyimportosfromdotenvimportload_dotenvfromlangchain.memoryimportConversationBufferMemoryfromlangchain_openaiimportChatOpenAIfromlangchain.chainsimportConversationChainfromlangchain_core.promptsimportPromptTemplate# 加载环境变量load_dotenv()defcreate_chatbot(memory_typebuffer):创建并返回一个配置了 Memory 的对话链llmChatOpenAI(modelgpt-3.5-turbo,temperature0.7,api_keyos.getenv(OPENAI_API_KEY))# 选择 Memory 类型ifmemory_typebuffer:memoryConversationBufferMemory(return_messagesTrue)elifmemory_typebuffer_window:memoryConversationBufferWindowMemory(k3,return_messagesTrue)else:memoryConversationBufferMemory(return_messagesTrue)# 定义一个更友好的系统提示词prompt_templatePromptTemplate.from_template(你是一个友好且专业的助手。请根据以下的对话历史和当前问题给出有帮助的回答。 如果历史对话中有相关信息请利用它们。 当前对话历史 {history} 人类{input} 助手)# 创建对话链conversationConversationChain(llmllm,memorymemory,promptprompt_template,verboseFalse# 设为 True 可查看详细的链执行过程)returnconversationdefmain():print( 启动 LangChain Memory 聊天机器人 (输入 quit 退出))print(-*50)botcreate_chatbot(memory_typebuffer)whileTrue:try:user_inputinput(\n你: )ifuser_input.lower()in[quit,exit,q]:print(助手: 再见期待下次与你聊天。)breakifuser_input.strip():responsebot.predict(inputuser_input)print(f助手:{response})exceptKeyboardInterrupt:print(\n\n程序被中断。)breakexceptExceptionase:print(f发生错误:{e})if__name____main__:main()3.3 运行与测试运行程序python app.py进行多轮对话测试观察机器人是否能记住上下文你: 你好我是张三来自北京。 助手: 你好张三很高兴认识你。北京是个很棒的城市。今天有什么可以帮你的吗 你: 我的名字是什么 助手: 你刚才说你叫张三。 你: 我来自哪个城市 助手: 你来自北京。4. 高级技巧与最佳实践4.1 将 Memory 持久化到数据库默认的 Memory 存储在内存中程序重启后记忆会消失。我们可以将其保存到数据库中。示例使用 SQLite 持久化ConversationBufferMemory(需安装langchain-community)fromlangchain_community.chat_message_historiesimportSQLChatMessageHistoryfromlangchain.memoryimportConversationBufferMemory# 创建基于 SQLite 的消息历史存储message_historySQLChatMessageHistory(session_iduser_session_123,# 会话ID用于区分不同用户或对话connection_stringsqlite:///chat_history.db)memoryConversationBufferMemory(chat_memorymessage_history,return_messagesTrue)# 现在 memory 的内容会被自动保存到数据库4.2 在 Chain 和 Agent 中使用 MemoryMemory 不仅可以用于简单的ConversationChain还可以集成到更复杂的链和智能体中。在自定义链中使用fromlangchain.chainsimportLLMChainfromlangchain.memoryimportConversationBufferMemoryfromlangchain_core.promptsimportPromptTemplate template你是一个编程助手。基于以下对话历史和当前问题给出代码建议。 历史对话 {chat_history} 当前问题{question} 代码建议promptPromptTemplate.from_template(template)memoryConversationBufferMemory(memory_keychat_history,input_keyquestion)chainLLMChain(llmllm,promptprompt,memorymemory,verboseTrue)# 调用链resultchain.invoke({question:如何在Python中反转列表})print(result[text])4.3 处理超长对话的策略分层记忆结合ConversationSummaryBufferMemory既保留近期细节又总结远期内容。向量检索记忆使用VectorStoreRetrieverMemory只召回与当前问题最相关的历史片段极大扩展有效记忆容量。关键信息提取在对话中主动识别并存储关键实体日期、决定、任务而非存储全部文本。

相关新闻

含多类型V2G电动汽车的微网日前-日内两阶段协同优化调度模型研究(Matlab代码实现)

含多类型V2G电动汽车的微网日前-日内两阶段协同优化调度模型研究(Matlab代码实现)

💥💥💞💞欢迎来到本博客❤️❤️💥💥 🏆博主优势:🌞🌞🌞博客内容尽量做到思维缜密,逻辑清晰,为了方便读者。 &#x1f381…

2026/8/21 21:53:25 阅读更多 →
中翰软件:用“本体论”给数据治理立规矩,用AI让规矩“活”起来

中翰软件:用“本体论”给数据治理立规矩,用AI让规矩“活”起来

数据治理的困境,往往源于“规矩不清”或“规矩不灵”。中翰软件最新发布的AI原生治理方案,正是从“立规矩”和“活应用”两端破局。 在“立规矩”层面,方案引入“本体论”,为企业核心业务实体(如客户、产品&#xff09…

2026/8/20 10:37:00 阅读更多 →
微服务中使用JWT 认证体系详解:HMAC vs RSA 签名、OAuth2 Token 获取机制

微服务中使用JWT 认证体系详解:HMAC vs RSA 签名、OAuth2 Token 获取机制

微服务中使用JWT 认证体系详解:HMAC vs RSA 签名、OAuth2 Token 获取机制 一、JWT 基础概念 1.1 什么是 JWT JWT(JSON Web Token)是一种紧凑的、自包含的令牌格式,用于在各方之间安全传递信息。它由三部分组成,用点号 …

2026/8/24 21:22:39 阅读更多 →

最新新闻

汉西建材市场对比:庆繁调色与配货实用性

汉西建材市场对比:庆繁调色与配货实用性

汉西建材市场观察:庆繁调色服务与配货实用性解析在武汉及周边地区的装修采购决策中,许多用户倾向于通过搜索“品牌服务实际体验如何”来评估供应商的交付能力。与其单纯依赖抽象的口碑评价,不如从具体的使用场景和筛选维度切入,理…

2026/8/26 1:37:25 阅读更多 →
AI让科学家做得更多但更差?关键在于判断力

AI让科学家做得更多但更差?关键在于判断力

最近关于“AI让科学家做得更多但做得更差”的讨论,在技术圈子里引起了不少波动。这个判断听起来有点反直觉,因为过去一年里,我们听到的几乎全是AI提效、AI自动化的好消息。无论是写代码、跑论文、做数据分析,还是搭实验流程&#…

2026/8/26 1:37:25 阅读更多 →
2026 上下文工程:换种说话方式,AI 效果天差地别?MonkeyCode 免费上手

2026 上下文工程:换种说话方式,AI 效果天差地别?MonkeyCode 免费上手

同一个问题,换个说法,AI 的回答质量天差地别——这背后就是 2026 年 AI 圈最热的关键词之一:上下文工程(Context Engineering)。 一个真实的小故事 运营小周想让 AI 帮自己整理一份竞品分析。她第一次问:“…

2026/8/26 1:37:25 阅读更多 →
私有化部署不是装个 Docker 就完事了——Harness 在内网落了三次才跑通

私有化部署不是装个 Docker 就完事了——Harness 在内网落了三次才跑通

说实话,我帮人部署 Harness 到企业内网这件事,第一次是栽在了一个我以为最不会出问题的地方上。 客户那边电话里说"环境都准备好了,服务器 Docker 也装好了,你过来搞就行"。我一听,这简单,docker…

2026/8/26 1:37:25 阅读更多 →
从金智秀新歌CLICK预告公开切入,《怕你忍不住》更值得完整听一遍

从金智秀新歌CLICK预告公开切入,《怕你忍不住》更值得完整听一遍

当睡前还不愿关灯的人走到夜里耳机刚戴上的那几秒,《怕你忍不住》往往会比空泛安慰更先开口——不是要你热闹起来,而是把说不清的那截情绪,轻轻按进旋律里。从雨天窗边切入《怕你忍不住》,会比直接说“值得听”更稳,因…

2026/8/26 1:37:25 阅读更多 →
Python爬虫实战:破解动态加载与反爬,批量获取王者荣耀高清皮肤素材

Python爬虫实战:破解动态加载与反爬,批量获取王者荣耀高清皮肤素材

1. 项目概述与核心价值最近在整理一些游戏素材,发现直接下载《王者荣耀》的英雄和皮肤图片费时费力,官方渠道也没有提供完整的、高分辨率的图包。作为一个喜欢用技术解决重复劳动的程序员,我第一时间就想到了用Python写个爬虫。这不仅仅是一个…

2026/8/26 1:36:25 阅读更多 →

日新闻

Python random 模块常用函数详解:从入门到实战

Python random 模块常用函数详解:从入门到实战

目录 1. 引言2. 准备工作3. 基础随机函数4. 序列相关函数5. 随机种子与复现6. 实战案例7. 注意事项8. 常见问题与排查9. 总结 1. 引言 摘要: 本文系统介绍 Python 标准库 random 模块中最常用的随机数生成函数。内容涵盖基础随机函数(random()、unifor…

2026/8/26 0:00:40 阅读更多 →
《Microsoft Sql server 2008 Internals》读书笔记--第三章Databases and Database Files(2)

《Microsoft Sql server 2008 Internals》读书笔记--第三章Databases and Database Files(2)

《Microsoft Sql server 2008 Internals》索引目录: 《Microsoft Sql server 2008 Internals》读书笔记--目录索引 在上篇文章中,主要介绍了创建数据库的基本语法和FileGroup的初步知识。需要注意的是: 关于FileGroup 如果你的系统是用Raid设备直接存…

2026/8/26 1:18:18 阅读更多 →
政务AI智能体怎么建?三种模式、三步路径与四个误区

政务AI智能体怎么建?三种模式、三步路径与四个误区

政务AI智能体已经从概念试点阶段,转入了政务服务的常态化落地应用;在实际使用过程中,它能自主理解办事需求、辅助完成填报申报、开展材料预审,并联动多个系统协同作业,真正嵌入到政务办理的全流程当中。但在落地推进过…

2026/8/26 1:18:18 阅读更多 →

周新闻

[光学原理与应用-521]:对光的错误理解与纠偏

[光学原理与应用-521]:对光的错误理解与纠偏

首先光是一种能量的载体和形态,宏观上观察到的光是由无数个微观的光量子组成的,每个光子在产生的瞬间,其在真空的空间中以确定不变的速度沿着一个初始的方向一直向前,在微观层面,每个光量子的运动轨迹是以波函数所展现…

2026/8/25 3:38:12 阅读更多 →
SIP通话转接原理与REFER方法实战解析

SIP通话转接原理与REFER方法实战解析

1. 通话转接不是“挂断再拨号”,而是SIP会话的动态重定向你有没有遇到过这样的场景:客服坐席A正在和客户通电话,突然需要把这通对话无缝转给专家坐席B,客户完全感知不到中间的断连——既没听到忙音,也没被要求重新拨号…

2026/8/25 3:38:18 阅读更多 →
Kolla-ansible单节点OpenStack部署实战:从环境准备到排坑指南

Kolla-ansible单节点OpenStack部署实战:从环境准备到排坑指南

1. 为什么选择Kolla-ansible来部署单节点OpenStack?如果你正在寻找一种能把OpenStack从“概念”快速变成“可用的实验环境”的方法,那么Kolla-ansible几乎是当前最主流、最省心的选择。我见过太多人卡在手动编译依赖、配置服务、处理版本冲突的泥潭里&am…

2026/8/25 3:38:23 阅读更多 →

月新闻

免费解锁百度网盘SVIP加速:macOS用户必备的下载提速终极指南

免费解锁百度网盘SVIP加速:macOS用户必备的下载提速终极指南

免费解锁百度网盘SVIP加速:macOS用户必备的下载提速终极指南 【免费下载链接】BaiduNetdiskPlugin-macOS For macOS.百度网盘 破解SVIP、下载速度限制~ 项目地址: https://gitcode.com/gh_mirrors/ba/BaiduNetdiskPlugin-macOS 还在为百度网盘macOS版的龟速下…

2026/8/24 20:22:44 阅读更多 →
终极ncmdump指南:3分钟实现网易云NCM音乐解密与格式转换

终极ncmdump指南:3分钟实现网易云NCM音乐解密与格式转换

终极ncmdump指南:3分钟实现网易云NCM音乐解密与格式转换 【免费下载链接】ncmdump 项目地址: https://gitcode.com/gh_mirrors/ncmd/ncmdump 还在为网易云音乐下载的NCM格式文件无法在其他播放器播放而烦恼吗?ncmdump解密工具帮你轻松解决这个困…

2026/8/25 10:31:12 阅读更多 →
HarmonyOS 应用开发《掌上英语》第81篇: 智能体卡片:为英语学习 App 打造桌面级学习助手

HarmonyOS 应用开发《掌上英语》第81篇: 智能体卡片:为英语学习 App 打造桌面级学习助手

AgentCard 智能体卡片:为英语学习 App 打造桌面级学习助手适用平台:HarmonyOS 7.0 (API 26 Beta)一、引言 HarmonyOS 7.0(API 26 Beta)新增了 AgentCard 智能体卡片能力,这是继 HMAF(鸿蒙智能体框架&#x…

2026/8/26 1:24:05 阅读更多 →