LangChain Agent 中间件全解与实战
前言为什么 Agent 需要中间件如果你用过 LangChain 构建过 AI Agent大概率遇到过这样的困境测试阶段一切正常部署到生产环境后却问题频发——上下文管理混乱、Agent 行为不可预测、工具调用失控……最后不得不写一堆自定义代码来补救。问题根源在于Agent 的可靠性取决于上下文工程。模型接收什么信息决定了它输出什么结果。而过多的配置参数、散落在各处的自定义逻辑让 Agent 变得难以维护和扩展。LangChain 1.0 引入的Agent 中间件Middleware正是为了解决这个问题。它借鉴了 Web 框架如 FastAPI的中间件模式在 Agent 执行流程的关键节点提供标准化的钩子Hooks让开发者能系统化地控制上下文、注入业务逻辑、增强生产可靠性。本文将带你全面理解 Agent 中间件的设计理念、核心钩子、内置实现并通过实战案例掌握自定义中间件的开发。一、中间件是什么Agent 的“信息调度中心”1.1 核心思想中间件本质上是一组可组合的执行钩子在 Agent 循环的各个阶段运行。它不改变 Agent 的核心逻辑模型调用 → 工具执行 → 循环而是在这些步骤前后插入自定义逻辑实现输入预处理PII 脱敏、提示词动态生成、对话摘要执行控制工具权限校验、人工审批HITL、重试与降级输出后处理结果验证、日志记录、状态更新1.2 中间件 vs 传统参数配置在 v1.0 之前Agent 的定制依赖大量参数和手写循环代码臃肿且难以复用。例如旧版AgentExecutor需要配置max_iterations、handle_parsing_errors、trim_intermediate_steps等十几个参数。中间件的优势在于模块化每个中间件独立负责一个功能如摘要、缓存、日志可组合多个中间件按顺序叠加互不干扰可复用写好的中间件可在不同项目间共享二、中间件的核心钩子HooksLangChain 中间件提供了 6 个核心钩子覆盖 Agent 的完整生命周期钩子执行时机典型用途before_agentAgent 启动前仅一次加载外部记忆、初始化资源、输入校验before_model每次模型调用前动态更新提示词、对话摘要、PII 脱敏wrap_model_call包裹模型调用重试机制、模型降级、动态工具绑定after_model模型响应后、工具执行前人工审批HITL、输出格式校验wrap_tool_call包裹工具调用工具权限控制、参数修改、缓存结果after_agentAgent 完成后仅一次保存结果、释放资源、发送通知钩子分为两种风格节点式钩子Node-style顺序执行通过返回dict更新 Agent 状态。如before_model、after_model包裹式钩子Wrap-style包裹核心调用可控制是否执行、重试或短路。如wrap_model_call、wrap_tool_call三、开箱即用的内置中间件LangChain 提供了多个生产级中间件可直接引入使用。3.1 对话摘要中间件SummarizationMiddleware长对话容易超出模型上下文窗口。该中间件在before_model阶段检测消息数量或 Token 阈值自动生成摘要替换历史消息。pythonfrom langchain.agents import create_agent from langchain.agents.middleware import SummarizationMiddleware agent create_agent( modelclaude-sonnet-4-6, tools[...], middleware[ SummarizationMiddleware( modelclaude-sonnet-4-6, trigger{tokens: 500} # 超过 500 token 触发摘要 ) ] )3.2 人工审批中间件HumanInTheLoopMiddleware敏感操作如发送邮件、删除数据需人工确认。该中间件在after_model阶段拦截指定工具调用挂起执行等待人工决策。pythonfrom langchain.agents.middleware import HumanInTheLoopMiddleware agent create_agent( modelclaude-sonnet-4-6, tools[send_email, read_email], middleware[ HumanInTheLoopMiddleware( interrupt_on{ send_email: { allowed_decisions: [approve, edit, reject] } } ) ], checkpointerMemorySaver() # 必须配合 checkpointer 实现暂停与恢复 )恢复挂起的执行pythonfrom langgraph.types import Command agent.invoke( Command(resume{decisions: [{type: approve}]}), config{configurable: {thread_id: session-123}} )3.3 PII 脱敏中间件PIIRedactionMiddleware在模型调用前自动识别并脱敏敏感信息邮箱、电话、身份证号等防止数据泄露。pythonfrom langchain.agents.middleware import PIIRedactionMiddleware agent create_agent( modelclaude-sonnet-4-6, middleware[ PIIRedactionMiddleware( patterns[email, phone, ssn], strategyredact # 或 mask, block ) ] )3.4 Anthropic 专属中间件针对 Claude 模型langchain-anthropic提供了专用中间件Prompt Caching缓存系统提示词和工具定义降低成本和延迟Bash Tool提供生产级的 Bash 命令执行支持 Docker 隔离Text Editor文件编辑工具支持状态持久化和文件系统两种模式pythonfrom langchain_anthropic.middleware import ( AnthropicPromptCachingMiddleware, ClaudeBashToolMiddleware ) agent create_agent( modelChatAnthropic(modelclaude-sonnet-4-6), middleware[ AnthropicPromptCachingMiddleware(ttl5m), ClaudeBashToolMiddleware( workspace_root/workspace, execution_policyDockerExecutionPolicy(imagepython:3.11) ) ] )四、实战自定义中间件开发内置中间件无法覆盖所有场景自定义中间件才是真正的杀手锏。我们通过两个实战案例演示如何开发。4.1 装饰器式中间件快速开发适合单钩子、逻辑简单的场景。使用before_model、wrap_tool_call等装饰器。需求为所有工具调用添加重试机制失败时返回友好提示。pythonfrom langchain.agents.middleware import wrap_tool_call, ToolCallRequest from langchain_core.messages import ToolMessage from typing import Callable wrap_tool_call def retry_on_tool_failure( request: ToolCallRequest, handler: Callable[[ToolCallRequest], ToolMessage] ) - ToolMessage: for attempt in range(3): try: return handler(request) except Exception as e: print(f工具 {request.tool_call[name]} 第 {attempt1} 次尝试失败: {e}) if attempt 2: return ToolMessage( contentf工具执行失败请重试或换一种方式。错误{e}, tool_call_idrequest.tool_call[id] ) # 不会执行到这里使用中间件pythonagent create_agent( modelgpt-4, tools[search, calculator], middleware[retry_on_tool_failure] )4.2 类式中间件复杂场景适合多钩子、需维护状态的场景。继承AgentMiddleware并实现对应钩子方法。需求根据用户技术水平动态调整模型和工具。专家用户使用高级模型 复杂工具新手使用轻量模型 基础工具。pythonfrom langchain.agents.middleware import AgentMiddleware, ModelRequest, ModelResponse from typing import Callable, Any from pydantic import BaseModel # 1. 定义上下文 Schema运行时传入不持久化 class UserContext(BaseModel): user_expertise: str beginner # beginner 或 expert # 2. 自定义中间件 class ExpertiseBasedToolMiddleware(AgentMiddleware): context_schema UserContext def wrap_model_call( self, request: ModelRequest, handler: Callable[[ModelRequest], ModelResponse] ) - ModelResponse: # 从运行时上下文读取用户级别 user_level request.runtime.context.get(user_expertise, beginner) if user_level expert: # 专家用户切换更强大的模型 高级工具 request request.override( modelgpt-4, tools[advanced_search, data_analysis, calculator] ) else: # 新手用户轻量模型 基础工具 request request.override( modelgpt-3.5-turbo, tools[simple_search, basic_calculator] ) return handler(request)使用中间件并在调用时传入上下文pythonagent create_agent( modelgpt-4, # 默认模型会被中间件覆盖 tools[simple_search, advanced_search, basic_calculator, data_analysis], middleware[ExpertiseBasedToolMiddleware()] ) # 专家用户调用 result agent.invoke( {messages: [HumanMessage(分析这份销售数据)]}, config{context: {user_expertise: expert}} )4.3 中间件状态管理如果中间件需要跨轮次持久化数据如调用计数、Token 用量可扩展 Agent 的状态 Schema。pythonfrom langchain.agents.middleware import AgentMiddleware, AgentState from typing import NotRequired class TrackingState(AgentState): model_call_count: NotRequired[int] class UsageTrackingMiddleware(AgentMiddleware): state_schema TrackingState def after_model(self, state: TrackingState, runtime) - dict[str, Any] | None: # 每次模型调用后更新计数 current state.get(model_call_count, 0) return {model_call_count: current 1}五、进阶中间件组合与执行顺序多个中间件按注册顺序执行类似洋葱模型进入阶段before_model按注册顺序执行包裹阶段wrap_model_call外层 → 内层退出阶段after_model按注册顺序的逆序执行pythonagent create_agent( modelgpt-4, middleware[ LoggingMiddleware(), # ① 先记录日志 RetryMiddleware(), # ② 再添加重试 PIIRedactionMiddleware() # ③ 最后脱敏 ] )执行顺序Logging.before_model→Retry.before_model→PII.before_model→模型调用→PII.after_model→Retry.after_model→Logging.after_model六、中间件 LangGraph在复杂工作流中使用中间件并非仅限单 Agent 使用。create_agent返回的 Agent 本身是一个 LangGraph 图可嵌入更大的工作流中中间件钩子依然有效。pythonfrom langgraph.graph import StateGraph, START from langchain.agents import create_agent, AgentState # 创建带中间件的 Agent email_agent create_agent( modelclaude-sonnet-4-6, tools[read_email, send_email], middleware[HumanInTheLoopMiddleware(interrupt_on{send_email: True})] ) # 嵌入更大的工作流 graph ( StateGraph(AgentState) .add_node(classify, classify_node) # 分类节点 .add_node(email_agent, email_agent) # Agent 节点 .add_edge(START, classify) .add_conditional_edges(classify, route) # 动态路由到不同 Agent .compile() )这种模式适合多 Agent 协作或预处理-处理-后处理的流水线场景。七、总结与最佳实践何时使用中间件生产级 Agent需要日志、重试、监控、降级复杂上下文管理动态提示词、对话摘要、PII 脱敏安全与合规工具权限控制、人工审批、数据隐私多租户或个性化根据用户角色动态调整模型和工具

相关新闻

2026年Java端口监听新突破:SO_REUSEPORT实现多进程并发监听

2026年Java端口监听新突破:SO_REUSEPORT实现多进程并发监听

同一个端口能不能被两个程序同时监听?这道经典的Java面试题在2026年有了新的技术答案。传统的网络编程教材告诉我们,一个端口在同一时间只能被一个进程监听,但随着现代操作系统和网络技术的发展,这个看似铁律的规则正在被打破。如…

2026/9/22 1:26:20 阅读更多 →
C#动态修改Windows默认打印机:从Win32 API调用到权限处理的完整指南

C#动态修改Windows默认打印机:从Win32 API调用到权限处理的完整指南

1. 项目概述与核心价值最近在做一个企业内部的小工具,需要根据不同的业务单据类型,自动切换到对应的打印机进行打印。比如,销售单用针式打印机打三联单,发货单用激光打印机打A4纸。这就涉及到一个核心需求:以编程方式动…

2026/9/22 4:25:34 阅读更多 →
PID控制算法详解:从原理到嵌入式C语言实现与调参

PID控制算法详解:从原理到嵌入式C语言实现与调参

1. 从“失控”到“掌控”:PID算法的核心价值如果你曾经尝试过让一个电机稳定在某个转速,或者让一个加热器保持恒温,又或者让一架无人机悬停在半空,那你大概率已经和“失控”打过交道了。设定一个目标值,系统要么反应迟…

2026/9/22 2:08:00 阅读更多 →

最新新闻

G大写实战:3步搞定Go命名规范与性能优化避坑指南

G大写实战:3步搞定Go命名规范与性能优化避坑指南

G大写实战:3步搞定Go命名规范与性能优化避坑指南 复制来的代码跑不通,报错满屏红,你是不是也卡在“为什么这个变量名改个大小写就编译失败”的尴尬境地?别慌,这不只是你的问题,90%的初学者在接触 Go…

2026/9/22 5:14:21 阅读更多 →
别再乱投简历了:网络刷票软件后端架构对比与完整示例

别再乱投简历了:网络刷票软件后端架构对比与完整示例

别再乱投简历了:网络刷票软件后端架构对比与完整示例 看了一堆教程还是不会写项目?别急,问题往往不在代码语法,而在架构选型的混乱。很多新手卡在“高并发”这三个字上,拿着单体架构的模板去套分布式场景,结果一上量就崩。今天不讲虚的,直接拆解…

2026/9/22 5:14:21 阅读更多 →
2026最新道具制作手写实现:版本升级API全变后的源码拆解

2026最新道具制作手写实现:版本升级API全变后的源码拆解

2026最新道具制作手写实现:版本升级API全变后的源码拆解 刚把项目从旧版框架升到2026最新稳定版,编译直接报错?别慌,这不是你代码写错了,是底层 ItemFactory 的 API…

2026/9/22 5:14:21 阅读更多 →
2026最新网易云音乐官网首页爬虫面试题拆解

2026最新网易云音乐官网首页爬虫面试题拆解

2026最新网易云音乐官网首页爬虫面试题拆解 上周带一个转行的哥们面大厂后端,第一题就卡住了。面试官扔给他一个需求:模拟爬取【网易云音乐官网首页】的热门榜单数据。这哥们愣了半天,说以前学的是老版API,现在版本升级后 API…

2026/9/22 5:14:21 阅读更多 →
Win7磁盘碎片整理源码剖析:从入门到精通避坑指南

Win7磁盘碎片整理源码剖析:从入门到精通避坑指南

Win7磁盘碎片整理源码剖析:从入门到精通避坑指南 刚接手一个老旧的Windows Server 2008 R2集群,老板甩过来一段Python脚本,说是用来自动触发磁盘碎片整理的。我满怀期待地跑了一下,结果控制台直接报错:…

2026/9/22 5:14:21 阅读更多 →
2026最新www.chinaedu.com面试突击,搞懂原理不挂科

2026最新www.chinaedu.com面试突击,搞懂原理不挂科

2026最新www.chinaedu.com面试突击,搞懂原理不挂科 面试现场,面试官盯着你的眼睛问:“讲讲这个核心原理,为什么这么设计?”你脑子一片空白,只能支支吾吾背八股文。这就是大多数应届生在 2026…

2026/9/22 5:13:20 阅读更多 →

日新闻

3台商务办公笔记本实测:手写实现环境配置,告别卡半天

3台商务办公笔记本实测:手写实现环境配置,告别卡半天

3台商务办公笔记本实测:手写实现环境配置,告别卡半天 配置环境就卡半天?别怪机器慢,多半是你没选对工具链。在Java、Go或Python的项目现场, 手写实现…

2026/9/22 0:00:41 阅读更多 →
剑帝加点速查手册:3分钟搞懂核心逻辑

剑帝加点速查手册:3分钟搞懂核心逻辑

剑帝加点速查手册:3分钟搞懂核心逻辑 面试被问原理答不上来,是不是常态?别慌。很多开发者对着 GitHub 开源仓库里的代码发呆,看似简单实则暗藏玄机。今天这份【剑帝加点】速查手册,直接带你拆解核心实现,把面试必考的原理讲透。…

2026/9/22 0:00:41 阅读更多 →
手写实现图片压缩网站核心:搞定WebP转换与质量调优

手写实现图片压缩网站核心:搞定WebP转换与质量调优

手写实现图片压缩网站核心:搞定WebP转换与质量调优 复制来的代码跑不通不知道怎么调?别慌,这种“复制粘贴地狱”在开发圈太常见了。尤其是做 图片压缩网站…

2026/9/22 0:00:41 阅读更多 →

周新闻

Flutter for OpenHarmony游戏卡片渐变背景实战:从原理到性能优化

Flutter for OpenHarmony游戏卡片渐变背景实战:从原理到性能优化

直接铺开项目本身吧。这几个月我一直在折腾一件事:用Flutter给OpenHarmony做一款游戏集合类的App,说白了就是把若干小游戏塞进一个壳里,用统一入口分发。这个方向本身不算新鲜,真正让我花了不少心思的,是首页那堆游戏卡…

2026/9/22 4:32:41 阅读更多 →
Word表格编号全攻略:从列表编号到题注交叉引用

Word表格编号全攻略:从列表编号到题注交叉引用

写Word文档,最让人头疼的往往是那些“看起来不起眼”的小问题。比如表格编号这事:今天在表后面多加了两个空白行,明天给客户交稿前发现整个章节的编号全部错位,光是挨个改序号就能耗掉大半个下午。我前阵子帮人整理一份上百页的技…

2026/9/22 4:38:57 阅读更多 →
从第一个站到第二个站:独立开发者的静态网站选型与落地实践

从第一个站到第二个站:独立开发者的静态网站选型与落地实践

1. 项目概述1.1 核心需求解析做独立开发者这几年,说实话,第一个网站上线的那天晚上我兴奋得没睡着。但等它跑了半年,流量惨淡、功能臃肿、代码自己都懒得看第二遍之后,我才慢慢琢磨明白一个道理:第一个网站是练手&…

2026/9/21 4:51:05 阅读更多 →

月新闻

持续集成 流水线自动化与 声明式交付 实践:原型怎样变成可用功能

持续集成 流水线自动化与 声明式交付 实践:原型怎样变成可用功能

持续集成 流水线自动化与 声明式交付 实践:原型怎样变成可用功能分类:[AI/大模型]细分主题:AI 增强型 CI/CD 流水线自动化与 GitOps 实践:Agent 工作流、工具调用与任务拆解:从原型到生产的验收清单很多团队在尝试用大…

2026/9/21 15:36:51 阅读更多 →
容器编排 生产环境运维与排障实战:复盘记录怎样真正派上用场

容器编排 生产环境运维与排障实战:复盘记录怎样真正派上用场

容器编排 生产环境运维与排障实战:复盘记录怎样真正派上用场分类:[工程技术]细分主题:Kubernetes 生产环境运维与排障实战:可复制的项目复盘模板与决策记录大部分团队的事故复盘报告,最后都变成了躺在 Confluence 或钉…

2026/9/21 15:36:51 阅读更多 →
容器 容器化技术与镜像安全管理:核心链路应该先拆哪一步

容器 容器化技术与镜像安全管理:核心链路应该先拆哪一步

容器 容器化技术与镜像安全管理:核心链路应该先拆哪一步分类:[工程技术]细分主题:Docker 容器化技术与镜像安全管理:核心链路的逐步实现与关键代码取舍面对一个积累了五六年历史包袱的单体架构应用(包含 Web 接口、后台…

2026/9/22 2:43:42 阅读更多 →