ChatGPT、Codex与Pro:Skills为什么正在成为AI团队的“工程记忆”?
当AI开发从单个Agent走向多Agent团队后一个新的问题开始出现不同Agent虽然使用相同模型却不一定采用相同的工作方式。负责开发的Agent可能偏向快速实现。负责测试的Agent可能只运行局部用例。负责代码审查的Agent可能采用另一套质量标准。同一个任务交给不同Agent可能出现代码风格不一致测试流程不一致交付格式不一致对修改范围的理解不同对“任务完成”的判断不同团队规范需要反复重新说明。真正的问题已经不只是Agent会不会完成任务而是多个Agent能不能按照同一套工程规则稳定工作这正是Skills开始变得重要的原因。OpenAI目前将Skills描述为一种可复用能力它可以把指令、参考资料、资源和可选脚本组合起来让ChatGPT或Codex在不同任务中可靠地重复同一套工作流。从系统角度看Skills不只是更长的提示词。它正在成为AI团队的“工程记忆”。一、普通提示词为什么难以支撑长期协作使用Codex完成单次任务时开发者通常会在提示词中说明要修改什么哪些文件不能动需要运行哪些测试最终怎样提交结果。这种方式在短任务中有效。但任务数量增加后团队需要不断重复同样的要求不修改公开接口。不随意升级依赖。修改后必须运行回归测试。输出变更文件和风险说明。遇到数据库调整时暂停确认。这些要求可能分散在聊天记录项目文档README团队规范个人经验历史任务中。每次重新复制不仅效率低还容易遗漏。更麻烦的是不同开发者写出的提示词并不完全相同。于是同一套团队规则会在传递过程中不断变形。提示词适合表达当前任务。Skills更适合保存可重复的工作方法。二、AI团队真正缺少的是组织记忆传统软件团队会通过以下方式保存工程经验编码规范测试流程发布清单架构文档安全要求Code Review标准故障处理手册。这些内容让新成员进入团队后不需要完全依赖口头传授。但AI Agent不会自动理解团队所有隐性规则。它可能知道一种通用最佳实践却不知道当前项目为什么不能升级某个依赖为什么旧接口必须保持兼容哪些测试属于合并前必测项哪些目录禁止自动修改团队要求使用什么交付格式遇到什么情况必须停止执行。如果这些规则只存在于人的经验中每个Agent都需要重新学习。Skills的价值就是把隐性经验转化成Agent可以重复调用的工程能力。三、Skills与项目文档有什么区别项目文档主要解决团队需要知道什么Skills更关注Agent遇到特定任务时应该怎样行动例如一份测试文档可能介绍项目使用哪些测试框架测试文件放在哪里不同测试的运行方式。而测试Skill可以进一步规定先识别受影响模块运行对应单元测试检查是否存在跳过用例再运行关键回归测试汇总失败原因不允许为了通过而降低断言按固定格式提交测试证据。文档提供知识。Skill把知识转化成可执行流程。两者不是互相替代。而是文档负责保存背景Skill负责组织行动。四、一个可靠的Skill应该包含什么Skills并不只是保存一句固定指令。根据当前官方文档它可以组合指令、资源、参考内容以及可选脚本用于重复执行特定工作流。从工程角度看一个可靠的Skill至少可以包含以下部分。1. 使用场景明确什么时候应该调用。例如修改核心业务代码后提交合并请求前涉及权限模块时需要执行安全检查时。2. 执行步骤说明任务的固定顺序。例如读取变更↓判断影响范围↓检查业务逻辑↓运行测试↓输出风险报告3. 工程约束明确不能做什么。例如不删除现有测试不降低原有断言不修改任务范围外的文件不自动操作生产环境不在没有证据时宣布完成。4. 参考资源可以包括项目规范接口文档测试说明安全规则输出模板。5. 完成标准规定最终需要提交变更文件执行命令测试结果剩余风险人工确认事项。Skill不是告诉Agent“尽量做好”。而是把“做好”的标准写成可重复执行的流程。五、多Agent团队为什么更需要Skills单个Agent偶尔偏离规范开发者还可以及时纠正。但多个Agent并行工作时规则不一致会迅速放大。例如开发Agent认为只要功能实现就可以完成。测试Agent认为局部测试通过就足够。审查Agent不知道团队禁止新增某类依赖。文档Agent使用了与项目不一致的术语。单独看每个Agent都完成了自己的任务。组合起来却可能形成无法直接交付的结果。Skills可以为不同Agent提供统一底线相同的代码规范相同的测试要求相同的交付格式相同的风险边界相同的停止条件。Agent可以有不同角色。但不能拥有完全不同的工程标准。六、Skills让团队规范从“提醒”变成“能力”传统提示方式通常是记得检查安全问题。这只是一条提醒。一个安全审查Skill则可以规定检查输入验证检查身份认证检查权限边界检查敏感信息检查错误信息暴露检查新增依赖风险输出发现位置和风险等级。前者依赖Agent临时理解。后者形成稳定流程。当规则被写成Skill后团队规范不再只是文档中的要求。而会成为Agent可以调用的实际能力。七、ChatGPT适合把隐性经验整理成Skills很多团队知道自己有一套工作方法但没有完整写下来。例如资深开发者可能凭经验判断哪类代码必须重点审查哪些测试失败不能忽略哪些改动容易影响兼容性什么情况下应该立即停止任务。这些知识通常分散在人的经验中。ChatGPT可以帮助团队访谈并整理现有流程找出重复出现的任务步骤把模糊经验转化成明确规则补充输入、输出和停止条件形成结构化Skill草案。ChatGPT在这里承担的不是工程执行。而是知识整理和规则设计。八、Codex负责把Skills应用到真实项目Codex的价值在于它可以把这些规则带入实际代码库。例如调用代码审查Skill后Codex可以查看本次代码差异识别影响模块对照项目规范运行指定测试搜索潜在风险按团队模板输出结果。OpenAI目前强调Skills可以帮助Codex在不同任务中一致应用团队的标准、工作流和工作方式减少每次任务都重复粘贴流程与要求。这意味着Codex不只是“知道规则”。还可以在工程环境中执行规则。九、Pro场景需要管理更大的Skill体系对于少量简单任务一个或两个Skills可能已经够用。但在更高频、更复杂的Pro协作场景中团队可能逐渐形成代码库分析Skill功能开发Skill单元测试Skill安全审查Skill性能检查Skill文档更新Skill发布前检查Skill故障复盘Skill。这时新的问题也会出现不同Skills是否存在重复哪个Skill优先级更高同一任务应该调用几个Skills规则冲突时以谁为准Skill更新后如何保持版本一致已失效的规范怎样退出。因此Skills数量增加后也需要治理。不能把所有经验都写成一个巨大的Skill。也不能为每个微小动作都创建独立Skill。更合理的结构通常是通用工程规则特定任务流程项目专属约束十、Skills不能替代人工判断Skills能够提高一致性但不能解决所有问题。它可能保存的是过时规则。也可能把不合理流程重复执行得更加稳定。例如旧架构约束已经失效测试流程没有覆盖新业务安全规范没有及时更新多个Skills之间出现冲突当前任务属于规则之外的特殊情况。因此团队仍然需要定期检查Skill是否仍然有效执行结果是否符合真实目标是否出现机械套用是否需要人工覆盖规则。工程记忆需要被维护。否则记忆也可能成为历史负担。十一、未来团队的竞争力可能藏在Skills里当不同团队都能使用相近的模型和Codex能力后模型本身的差距可能不再是唯一决定因素。真正拉开差距的可能是团队沉淀了什么如何拆分任务如何分析代码库如何控制修改范围如何验证结果如何审查风险如何处理失败如何完成交付。这些经验过去主要存在于资深工程师的大脑里。未来它们可能逐渐被整理成可复用规则可执行流程可版本管理的Skills可被多个Agent共同调用的团队能力。模型可以被所有人使用。但团队独有的工程方法需要长期积累。结语多Agent团队解决的是任务分工和并行执行。Skills解决的是不同Agent怎样保持统一标准。ChatGPT可以帮助团队整理经验、设计规则和构建工作流。Codex可以把这些Skills应用到代码库分析、开发、测试和审查中。Pro支撑的则是更高频、更复杂、更长期的Agent协作场景。未来AI团队真正需要保存的不只是聊天记录和任务上下文。还包括怎样分析。怎样执行。怎样验证。怎样停止。怎样交付。当这些经验能够被稳定复用时Skills就不再只是辅助功能。它会逐渐成为AI团队的工程记忆。

相关新闻

云原生技术的2026盘点:K8s、eBPF与WASM的三足鼎立

云原生技术的2026盘点:K8s、eBPF与WASM的三足鼎立

云原生技术的2026盘点:K8s、eBPF与WASM的三足鼎立一、云原生格局的重新洗牌 Kubernetes 仍是云原生编排的主力工具,但它不再是唯一需要关注的技术。eBPF 被用于网络、观测和安全,WASM 则进入轻量运行时和边缘计算场景。三者负责的层次不同&am…

2026/7/29 2:02:04 阅读更多 →
SmartStor如何备份和恢复操作系统文件

SmartStor如何备份和恢复操作系统文件

1.登录SmartStor备份系统登录后管理界面2.备份文件数据2.1 在左边菜单中【备份】->【备份策略】页面点【创建】按钮进入策略创建向导2.2 选择备份数据源2.3 配置备份计划备份计划可以按月、按周、按天、按小时进行规划,根据不同的数据类型搭配不同的备份级别。比…

2026/7/29 2:01:04 阅读更多 →
AI智能体时代已经到来 普通开发者如何抓住下一波技术红利

AI智能体时代已经到来 普通开发者如何抓住下一波技术红利

人工智能的发展速度远远超过了很多人的预期。从最初的聊天机器人,到如今能够编程、写文档、分析数据、生成图片甚至自动执行任务的 AI 智能体(AI Agent),软件开发正在发生一次新的变革。近年来,AI Agent 已逐渐成为技术…

2026/7/29 2:01:04 阅读更多 →

最新新闻

MAI Gateway 技术解析:OpenAI 越狱一周才被发现,企业网关层该如何补位

MAI Gateway 技术解析:OpenAI 越狱一周才被发现,企业网关层该如何补位

2026 年 7 月 27 日,OpenAI 失控 AI 内幕曝光:基于 GPT-5.6 Sol 和一个更强大未发布模型的测试智能体,在内部测试中突破沙盒容器限制,连接互联网并入侵了 Hugging Face 服务器。从 7 月 9 日首次逃逸尝试,到 7 月 19 日…

2026/7/29 2:23:12 阅读更多 →
[特殊字符] “YOLO 模式” 首次曝光:AI 代理自主渗透泰国财政部,网络间谍进入全自动化时代

[特殊字符] “YOLO 模式” 首次曝光:AI 代理自主渗透泰国财政部,网络间谍进入全自动化时代

黑客给 AI 下达指令后就去睡觉了——AI 自己完成了侦察、提权、横向移动全部攻击链。 你好,我是老张。 如果说上个月 OpenAI 模型“越狱”入侵 Hugging Face 还是一次意外的测试失控,那这一次,攻击者已经主动把 AI 代理投入了真实的网络间谍…

2026/7/29 2:23:12 阅读更多 →
基于Mathematica与Arduino的人脸跟踪云台系统设计与实现

基于Mathematica与Arduino的人脸跟踪云台系统设计与实现

1. 项目缘起:当数学引擎遇见物理世界几年前,我在做一个智能交互装置的原型时,遇到了一个头疼的问题:我需要一个能实时处理摄像头画面、识别特定目标(比如人脸),并据此控制物理设备(比…

2026/7/29 2:23:12 阅读更多 →
MiniMax呼吁AI模型权重开放:技术实践与行业影响分析

MiniMax呼吁AI模型权重开放:技术实践与行业影响分析

MiniMax 呼吁开放权重与开源未来:AI 模型开源的技术实践与影响分析在人工智能快速发展的今天,模型权重的开放与开源生态建设成为行业热议话题。作为国内领先的 AI 初创企业,MiniMax(稀宇科技)近期公开呼吁开放模型权重…

2026/7/29 2:23:11 阅读更多 →
ESP32与开源大模型融合:打造智能微型桌面机器人全流程指南

ESP32与开源大模型融合:打造智能微型桌面机器人全流程指南

1. 项目概述:当创客周刊遇上开源大模型与微型机器人又到了每周的创客时间。这期DF创客周刊第35期,标题里两个关键词特别抓人:微型桌面机器人和开源大语言模型。乍一看,一个玩的是精巧的硬件机电控制,另一个是前沿的AI软…

2026/7/29 2:23:11 阅读更多 →
APDS-9960传感器实战:从I2C通信到色彩校准的嵌入式开发指南

APDS-9960传感器实战:从I2C通信到色彩校准的嵌入式开发指南

1. 项目缘起:从“免费试用”到“深度把玩”的契机最近在逛一些硬件开发社区时,发现了一个挺有意思的免费试用活动,主角是一款集成了红外手势识别、RGB颜色检测和环境光检测的传感器模块。说实话,这类“三合一”的传感器在创客圈里…

2026/7/29 2:22:11 阅读更多 →

日新闻

【RT-DETR多模态创新改进】CVPR 2025 | 独家特征融合创新改进篇 | 引入RLAB残差线性注意力模块,有效融合并强调多尺度特征,多种改进点,适合红外与可见光融合目标检测任务,有效涨点

【RT-DETR多模态创新改进】CVPR 2025 | 独家特征融合创新改进篇 | 引入RLAB残差线性注意力模块,有效融合并强调多尺度特征,多种改进点,适合红外与可见光融合目标检测任务,有效涨点

一、本文介绍 🔥本文在RT-DETR多模态融合目标检测中引入RLAB残差线性注意力模块,可在不同模态特征交互阶段进行多次残差细化,使可见光、红外等特征在尺度、语义和空间位置上更好对齐;随后将细化特征与解码器输出拼接并生成Q、K、V,通过线性注意力自适应强化关键通道、目…

2026/7/29 0:00:23 阅读更多 →
AI编程系列02:合并知识功能,给 AI 问数和 RAG 场景打基础

AI编程系列02:合并知识功能,给 AI 问数和 RAG 场景打基础

AI编程系列02:合并知识功能,给 AI 问数和 RAG 场景打基础 在上一期「AI编程系列」中,我们学习了如何构建一个基础的 AI 问答系统,通过简单的输入输出让模型回应问题。但现实世界中的 AI 应用往往需要处理更复杂的场景:…

2026/7/29 0:00:23 阅读更多 →
AI智能体开发实战:从工具调用到企业级部署

AI智能体开发实战:从工具调用到企业级部署

1. 从被动问答到主动执行:AI Agent的范式转变过去两年,大语言模型最显著的应用形态是聊天机器人——用户提问,AI回答。但真正的生产力革命发生在2023年下半年:当AI学会主动调用工具完成任务时,生产力工具的历史被彻底改…

2026/7/29 0:00:23 阅读更多 →

周新闻

深度学习道路桥梁裂缝检测系统 道路桥梁裂缝检测数据集 道路桥梁病害识别检测数据集

深度学习道路桥梁裂缝检测系统 道路桥梁裂缝检测数据集 道路桥梁病害识别检测数据集

深度学习道路桥梁裂缝检测系统 数据集6000张 完整源码已标注数据集训练好的模型环境配置教程程序运行说明文档,可以直接使用!系统支持图片、视频、摄像头等多种方式检测裂缝,功能强大实用。 1数据集6000张 8各类别

2026/7/28 12:04:22 阅读更多 →
深度学习YOLO模型如何训练 PUBG 绝地求生目标检测数据集

深度学习YOLO模型如何训练 PUBG 绝地求生目标检测数据集

pubg数据集 精选原图1.42万数据 1.49万标签 无任何重复、算法增强或冗余图像! pubg绝地求生目标检测数据集 1分类:e_body,14905个标签,txt格式 共计14244张图,99%为640*640尺寸图像 适合yolo目标检测、AI训练关键词&am…

2026/7/28 8:29:16 阅读更多 →
Apex英雄目标检测数据集 深度学习框架YOLO如何训练APEX数据集

Apex英雄目标检测数据集 深度学习框架YOLO如何训练APEX数据集

Apex检测数据集数据集详情检测类别: allies enemy tag图片总量:7247张训练集:5139张验证集:1425张测试集:683张标注状态:全部已标注,即拿即用数据格式:支持YOLO格式及其他格式&#…

2026/7/28 5:03:42 阅读更多 →

月新闻