Loop Engineering:从「写 Prompt」到「设计循环」的范式跃迁
2023 年所有人都在学 Prompt Engineering——怎么写好一条指令让 AI 给出更好的回答。到了 2025 年这个技能已经不够用了。Claude Code、Codex、OpenClaw 等 AI 编程智能体的崛起揭示了一个更深层的变化开发者不再逐条输入 Prompt而是设计一套循环系统让 AI 自主地执行、验证、迭代直到任务完成。与此同时OpenAI 在 2026 年初提出了另一个关键概念——Harness Engineering定义了让模型变成智能体的基础设施层。这两个概念加在一起构成了当下 AI 工程最完整的实践图景。用 Addy Osmani 的话说“Stop prompting your coding agent, and start designing the loop that prompts it for you.” 别再手动给你的 Agent 写 Prompt 了去设计那个替你写 Prompt 的循环。四层图景Prompt → Context → Harness → Loop要理解 Loop Engineering 的位置需要看清 AI 工程的四个层次。它们不是替代关系而是层层叠加Prompt Engineering2022-2023解决的是这一轮对话怎么说的问题。核心技能是语言精确性——用对词、用对格式、用对 few-shot 示例让模型在单次交互中给出理想响应。工作单元是一条 Prompt持续几秒到几分钟。Context Engineering2024-2025解决的是模型这一轮看到什么的问题。当 Agent 开始调用工具、检索文档、维护对话历史工程重心转向管理上下文——什么信息该放进去、什么该过滤掉、如何让 RAG检索增强生成返回准确结果。核心技能从语言转向数据工程。Harness Engineering2026解决的是怎么把裸模型变成一个能干活的安全智能体的问题。它定义了一套基础设施公式Agent Model Harness。Harness 是包裹在模型外面的所有运行时组件——系统提示词、工具注册与调度、权限控制、沙箱环境、上下文窗口管理、记忆持久化、子 Agent 编排。模型只负责预测下一个 tokenHarness 负责让这些预测真正做事。用 SixDegree 的比喻模型是引擎Harness 是底盘、变速箱和方向盘。Loop Engineering2026解决的是跨越多轮、持续数小时甚至数天的工作怎么自主推进的问题。它运行在 Harness 之上设计整个迭代循环——触发条件、目标定义、行动编排、结果验证、状态记忆。核心技能从写好指令变为系统设计。一个简单的类比如果把 AI Agent 比作一辆自动驾驶汽车那 Prompt 是方向盘上的指令“左转”Context 是车载传感器看到的路况信息Harness 是整辆车的底盘、引擎、刹车和安全系统而 Loop 是自动驾驶算法——它决定了车怎么在没有人类干预的情况下从 A 点开到 B 点。Harness 和 Loop 的关系尤其密切。正如博客园一篇拆解文章所说“Harness 提供能力Loop 自动化执行。” 没有 HarnessLoop 无处运行没有 LoopHarness 只是一个等待人类指令的工具而不是一个自主工作的同事。Harness EngineeringLoop 下面的地基OpenAI 在 2026 年 2 月正式提出 Harness Engineering 概念时用了一个清晰的心智模型Harness 由前馈引导Feedforward Guides和反馈传感器Feedback Sensors两部分组成共同约束 Agent 的行为边界。前馈引导是事前控制——在 Agent 开始行动之前通过系统提示词定义角色和规则、通过工具注册表限定可用能力、通过权限模型决定什么能做什么不能做。这些组件在 Agent 运行前就已经就位决定了它的性格和能力范围。反馈传感器是事后检查——在 Agent 行动之后通过自动化测试、lint 检查、CI 流水线、独立验证 Agent 等机制确认输出是否符合预期。Martin Fowler 在其文章中特别强调了Keep quality left原则把快速检查尽可能前置不要等到最后才验证。一个完整的 Harness 包含以下核心组件组件职责类比System Prompt定义 Agent 的角色、规则、行为边界员工手册Tools Dispatch注册可用工具调度 Agent 的工具调用请求工具箱Permissions Guardrails权限控制、安全护栏、kill switch安全规程Sandbox隔离的执行环境防止 Agent 影响生产系统实验室Context Window Manager管理上下文窗口的填充、压缩和轮换短期记忆管理员Memory跨轮次、跨运行的持久化状态长期记忆Orchestration子 Agent 的创建、分配、协调项目经理Logging Observability行为日志、可追溯性、监控告警黑匣子Harness 的质量直接决定了 Agent 的上限。一个好的 Harness 让模型感觉很强——因为它的每个行动都有工具支撑、有权限保护、有验证兜底。一个差的 Harness 让模型看起来不靠谱——不是模型本身不行而是基础设施拖了后腿。这也是为什么在 Claude Code、Codex 等产品的实际使用中经验丰富的开发者花最多时间打磨的不是 Prompt而是 Harness 的配置——哪些工具该开放、哪些权限该收紧、沙箱该怎么设置、验证器该怎么写。这些看不见的工作才是 Agent 表现好坏的决定性因素。一个 Loop 的五个核心组件一个设计良好的 Loop 不是让 AI 一直跑那么简单。它包含五个缺一不可的工程模块1. 触发器Trigger——什么启动这个循环可以是一个定时任务每天凌晨 2 点执行、一个事件CI 流水线报错时自动触发、或一条人类指令“把这批 P1 issue 分掉”。触发器定义了 Loop 的起点和运行条件。2. 目标Goal——循环什么时候算完成目标必须是可验证的终态而不是一句模糊的描述。“所有测试通过”“所有 P1 issue 已分类并评论”“重构后的模块保持原有行为不变”——这些都是好目标因为它们可以用自动化手段判定。3. 行动Actions——Agent 可以调用哪些工具文件读写、终端命令、API 调用、数据库查询、甚至生成子 Agent 来并行处理。行动是 Agent 从能说到能做的桥梁也是 Loop 与纯对话系统的本质区别。4. 验证Verification——怎么确认目标真的达成了这是 Loop Engineering 最容易被忽视却最关键的环节。优先使用确定性验证——单元测试、lint 检查、CI 流水线结果而不是让 LLM 自己判断我做完了。一个常见的反模式是 Agent 声称任务完成但实际上跳过了验证步骤这就是所谓的幻觉成功Hallucinated Success。5. 记忆Memory——Agent 在跨轮次运行时如何保持状态模型的上下文窗口有限而且每次运行之间不共享记忆。成熟的 Loop 会把关键状态持久化到外部——Markdown 文件、数据库、错误日志——避免上下文腐烂Context Rot也就是上下文窗口被塞满后模型质量急剧下降的问题。把这五个组件串起来一个 Loop 的伪代码大致是这样的state init_state(goal)for step in range(MAX_STEPS): thought model.reason(state) # 推理 action model.choose_action(state) # 选择行动 result tools.execute(action) # 执行 state update(state, thought, action, result) state compact(state) # 上下文压缩 if verifier.passes(state): return success(state) # 验证通过完成 if no_progress(state): return escalate_to_human(state) # 无进展交还人类return escalate_to_human(state) # 达到上限交还人类Prompt vs Context vs Harness vs Loop一张表说清维度Prompt EngineeringContext EngineeringHarness EngineeringLoop Engineering解决的问题这一轮怎么说这一轮看到什么模型怎么变成能做事的 Agent多轮工作怎么自主推进工作单元单条 Prompt一次上下文构建一套运行时基础设施整个自主运行循环核心技能措辞精准数据工程系统设计 / 安全工程编排与流程设计失败模式语义歧义信息过期 / 噪音权限泄漏 / 工具故障循环漂移 / 无限重试时间跨度秒到分钟单次交互持续运行的基础设施分钟到小时甚至数天角色定位写作者数据工程师平台 / 安全工程师系统架构师最本质的区别在于Prompt 管说什么Context 管看到什么Harness 管能做什么Loop 管怎么持续做。四层叠加才是一个完整的生产级 AI Agent 工程体系。实战场景Loop 在跑什么场景一自动修 Bug 循环。CI 流水线报错Loop 被触发。Agent 读取失败的测试日志定位可能的出错代码生成修复补丁重新跑测试。如果绿灯自动开 PR如果连续三次尝试都失败升级给人类开发者。整个过程无需人工干预但人类始终保有最终决策权。场景二Issue 分诊循环。每天凌晨Loop 自动扫描过去 24 小时新增的 GitHub Issue根据预定义的分类规则打上标签、指派给对应团队、留下初步评论。验证机制是检查每个 Issue 是否已被正确分类并指派遗漏的进入待人工处理队列。场景三多 Agent 协作编排。一个主管 Agent拆解任务派出多个专家 Agent并行执行各自的 Loop。完成后一个独立的验证 Agent检查结果的正确性——注意不是让执行者自我评估而是用一个独立的模型做交叉验证。这种 Maker-Checker 分离模式是多 Agent Loop 的核心安全机制。四个常见陷阱Loop Engineering 的红利很大但设计不当的 Loop 比不写 Loop 更危险。上下文腐烂Context Rot——随着循环轮次增加上下文窗口被历史数据塞满模型的推理质量急剧下降。解法是上下文压缩只保留最近 N 轮的完整内容更早的压缩为摘要关键状态持久化到外部文件。无进展循环No-Progress Loop——Agent 反复调用同一个工具、得到相似的结果、不知道该停。解法是无进展检测如果连续 K 轮没有新的信息产出自动终止并交给人类。奖励作弊Reward Hacking——Agent 找到了通过验证的捷径但偏离了真实目标。比如测试跑不过就删掉测试文件。解法是验证器必须覆盖行为完整性而不仅仅是表面指标。成本失控Cost Blowup——长时间运行的 Loop 会消耗大量 Token 和 API 调用。解法是预算守卫设置单次运行的最大 Token 上限和最大步数超限即停。四种设计模式从简到繁在实践中Loop 的设计模式可以按复杂度分为四个层级选择哪种取决于任务的性质ReActReason Act是最基础的模式推理 → 行动 → 观察单循环跑到底。适合目标明确、步骤线性的任务比如修这个 Bug 并让测试通过。绝大多数场景从这个模式起步就够了。Reflexion反思模式在 ReAct 基础上增加了自我批评环节Agent 执行完后回顾自己的输出识别错误或不足带着反思进入下一轮。适合需要迭代优化的任务比如代码审查或文档撰写。Evaluator-Optimizer评估-优化把执行和验证拆成两个独立角色。一个 Agent 负责生产另一个负责评估打分分数不达标就打回重做。适合质量要求严格的输出比如安全合规检查或数据清洗。Orchestrator-Workers编排者-工人是多 Agent 协作模式一个编排 Agent 拆解任务、分配子任务给多个工人 Agent各自运行独立 Loop最后汇总结果。适合需要并行处理的复杂任务比如同时分析十个竞品并生成对比报告。关键原则是从最简单的模式开始。一个带确定性验证器的 ReAct 循环通常优于一个精心设计但调试困难的多 Agent 系统。只有当任务确实需要并行、分工或独立验证时才值得引入更复杂的模式。写在最后Loop Engineering 和 Harness Engineering 不是全新的学科——它们的思想根植于控制论的反馈回路、软件工程的运行时基础设施。但在大模型时代它们第一次从理论走进工程实践成为了 AI 从工具进化为同事的关键基础设施。Prompt、Context、Harness、Loop 四层工程能力不是替代关系而是叠加关系。一个优秀的 AI 工程师需要能写好 Prompt、管好 Context、搭好 Harness、设计好 Loop——四层能力缺一不可。如果你刚刚开始接触这些概念最务实的起步方式是先为你的 Agent 搭建一个扎实的 Harness好的系统提示词、合理的工具集、严格的权限控制、确定性验证器然后在它之上设计一个最简单的 ReAct 循环推理-行动-观察跑起来看看。记住那句核心原则Prefer the simplest pattern that works.一个带确定性验证器的简单 Loop胜过一套精心设计的多 Agent 系统。先让它跑起来再让它变复杂。学AI大模型的正确顺序千万不要搞错了2026年AI风口已来各行各业的AI渗透肉眼可见超多公司要么转型做AI相关产品要么高薪挖AI技术人才机遇直接摆在眼前有往AI方向发展或者本身有后端编程基础的朋友直接冲AI大模型应用开发转岗超合适就算暂时不打算转岗了解大模型、RAG、Prompt、Agent这些热门概念能上手做简单项目也绝对是求职加分王给大家整理了超全最新的AI大模型应用开发学习清单和资料手把手帮你快速入门学习路线:✅大模型基础认知—大模型核心原理、发展历程、主流模型GPT、文心一言等特点解析✅核心技术模块—RAG检索增强生成、Prompt工程实战、Agent智能体开发逻辑✅开发基础能力—Python进阶、API接口调用、大模型开发框架LangChain等实操✅应用场景开发—智能问答系统、企业知识库、AIGC内容生成工具、行业定制化大模型应用✅项目落地流程—需求拆解、技术选型、模型调优、测试上线、运维迭代✅面试求职冲刺—岗位JD解析、简历AI项目包装、高频面试题汇总、模拟面经以上6大模块看似清晰好上手实则每个部分都有扎实的核心内容需要吃透我把大模型的学习全流程已经整理好了抓住AI时代风口轻松解锁职业新可能希望大家都能把握机遇实现薪资/职业跃迁这份完整版的大模型 AI 学习资料已经上传CSDN朋友们如果需要可以微信扫描下方CSDN官方认证二维码免费领取【保证100%免费】

相关新闻

大模型代币消耗优化:从机制原理到工程实践完整指南

大模型代币消耗优化:从机制原理到工程实践完整指南

最近在优化大模型调用成本时,遇到了一个颇具讽刺性的问题:原本想通过精细化提示词设计来节省代币消耗,结果在反复调试过程中反而消耗了更多资源。这种"省着省着,窟窿等着"的经历,相信不少开发者在接触LLM AP…

2026/7/30 2:04:37 阅读更多 →
AI工具链如何优化学术专著写作全流程

AI工具链如何优化学术专著写作全流程

1. 学术专著写作的痛点与AI解决方案去年协助一位教授完成人工智能领域专著时,我们团队在文献整理阶段就耗费了整整三个月。每天面对数百篇论文PDF,手动提取关键数据到Excel表格,这种低效工作模式让我开始系统性探索AI写作工具链。如今借助现代…

2026/7/29 19:40:16 阅读更多 →
删不掉的 junction:NTFS 悬空链接排查记

删不掉的 junction:NTFS 悬空链接排查记

清理一个 scoop 卸载残留的目录联接(junction)时,我连续撞上一堵墙:普通用户删不掉、管理员删不掉、清只读属性删不掉、改 ACL(Access Control List,访问控制列表,NTFS 记录"谁能对某个文件…

2026/7/26 18:10:25 阅读更多 →

最新新闻

UnrealPakViewer深度解析:虚幻引擎Pak文件可视化分析与资源优化终极方案

UnrealPakViewer深度解析:虚幻引擎Pak文件可视化分析与资源优化终极方案

UnrealPakViewer深度解析:虚幻引擎Pak文件可视化分析与资源优化终极方案 【免费下载链接】UnrealPakViewer 查看 UE4 Pak 文件的图形化工具,支持 UE4 pak/ucas 文件 项目地址: https://gitcode.com/gh_mirrors/un/UnrealPakViewer 在虚幻引擎项目…

2026/7/30 16:17:04 阅读更多 →
Python+LangChain+Playwright:构建自修复UI测试Agent的6步极简法(限免调试工具包)

Python+LangChain+Playwright:构建自修复UI测试Agent的6步极简法(限免调试工具包)

更多请点击: https://kaifayun.com 第一章:AI 写自动化测试 人工智能正深度重构软件质量保障体系,其中自动生成测试用例已成为提升测试效率与覆盖率的关键路径。现代AI驱动的测试生成工具(如Testim、Applitools、以及基于LLM的定…

2026/7/30 16:17:04 阅读更多 →
STM32 PWM从原理到实战:调光、电机控制与高级应用详解

STM32 PWM从原理到实战:调光、电机控制与高级应用详解

1. 从“开关”到“呼吸灯”:PWM到底是什么? 如果你玩过单片机,尤其是STM32,那PWM这个词你肯定不陌生。它几乎是所有涉及到“控制”的项目里,出场率最高的技术之一。从让一个LED灯实现呼吸效果,到驱动一个电…

2026/7/30 16:17:04 阅读更多 →
如何快速掌握开源Verilog仿真工具:Icarus Verilog完整指南

如何快速掌握开源Verilog仿真工具:Icarus Verilog完整指南

如何快速掌握开源Verilog仿真工具:Icarus Verilog完整指南 【免费下载链接】iverilog Icarus Verilog 项目地址: https://gitcode.com/gh_mirrors/iv/iverilog 还在寻找功能强大且完全免费的Verilog仿真解决方案吗?Icarus Verilog作为一款遵循IEE…

2026/7/30 16:17:04 阅读更多 →
Spring Boot WebSocket实战:原生@ServerEndpoint与WebSocketHandler对比详解

Spring Boot WebSocket实战:原生@ServerEndpoint与WebSocketHandler对比详解

1. 从HTTP到WebSocket:为什么我们需要它? 如果你做过实时聊天、股票行情推送或者在线游戏,肯定遇到过一个问题:HTTP协议太“慢”了。这里的慢,不是指数据传输速度,而是指它的“一问一答”模式。客户端发个请…

2026/7/30 16:17:04 阅读更多 →
67-附录F:USB硬件波形分析

67-附录F:USB硬件波形分析

专栏总目录 文章目录 概述 一、USB包结构基础 1.1 包的组成 1.2 PID类型 二、典型波形分析 2.1 SOF(帧起始)包 2.2 IN令牌包 2.3 NAK握手包 2.4 SETUP包(控制传输) 2.5 DATA0数据包 三、枚举阶段完整波形 四、知识总结 概述 除了使用USB分析仪,还可以使用逻辑分析仪对USB信号…

2026/7/30 16:16:04 阅读更多 →

日新闻

Windows驱动存储终极清理工具:DriverStoreExplorer完全指南

Windows驱动存储终极清理工具:DriverStoreExplorer完全指南

Windows驱动存储终极清理工具:DriverStoreExplorer完全指南 【免费下载链接】DriverStoreExplorer Driver Store Explorer 项目地址: https://gitcode.com/gh_mirrors/dr/DriverStoreExplorer 您是否曾因Windows系统盘空间不足而烦恼?是否遇到过设…

2026/7/30 0:00:13 阅读更多 →
如何3步掌握Video Download Helper:网页视频下载的完整实战指南

如何3步掌握Video Download Helper:网页视频下载的完整实战指南

如何3步掌握Video Download Helper:网页视频下载的完整实战指南 【免费下载链接】VideoDownloadHelper Chrome Extension to Help Download Video for Some Video Sites. 项目地址: https://gitcode.com/gh_mirrors/vi/VideoDownloadHelper 你是否曾经在浏览…

2026/7/30 0:00:13 阅读更多 →
“双减”后首个AI备课压力测试报告:覆盖32所中小学的176节AI辅助课,暴露4大隐性增负节点

“双减”后首个AI备课压力测试报告:覆盖32所中小学的176节AI辅助课,暴露4大隐性增负节点

更多请点击: https://intelliparadigm.com 第一章:AI 教师备课辅助 AI 教师备课辅助系统正逐步成为教育数字化转型的核心支撑工具,它并非替代教师,而是通过语义理解、知识图谱与多模态生成能力,将教师从重复性劳动中解…

2026/7/30 0:00:13 阅读更多 →

周新闻

深度学习道路桥梁裂缝检测系统 道路桥梁裂缝检测数据集 道路桥梁病害识别检测数据集

深度学习道路桥梁裂缝检测系统 道路桥梁裂缝检测数据集 道路桥梁病害识别检测数据集

深度学习道路桥梁裂缝检测系统 数据集6000张 完整源码已标注数据集训练好的模型环境配置教程程序运行说明文档,可以直接使用!系统支持图片、视频、摄像头等多种方式检测裂缝,功能强大实用。 1数据集6000张 8各类别

2026/7/29 22:18:20 阅读更多 →
深度学习YOLO模型如何训练 PUBG 绝地求生目标检测数据集

深度学习YOLO模型如何训练 PUBG 绝地求生目标检测数据集

pubg数据集 精选原图1.42万数据 1.49万标签 无任何重复、算法增强或冗余图像! pubg绝地求生目标检测数据集 1分类:e_body,14905个标签,txt格式 共计14244张图,99%为640*640尺寸图像 适合yolo目标检测、AI训练关键词&am…

2026/7/29 14:34:28 阅读更多 →
Apex英雄目标检测数据集 深度学习框架YOLO如何训练APEX数据集

Apex英雄目标检测数据集 深度学习框架YOLO如何训练APEX数据集

Apex检测数据集数据集详情检测类别: allies enemy tag图片总量:7247张训练集:5139张验证集:1425张测试集:683张标注状态:全部已标注,即拿即用数据格式:支持YOLO格式及其他格式&#…

2026/7/29 15:00:03 阅读更多 →

月新闻