年薪340万也招不到人!前OpenAI大牛成立35人“AI防火墙”:最大问题是“缺人”
整理 | 郑丽媛出品 | CSDNIDCSDNnews前不久OpenAI 公布了其智能体入侵 HuggingFace 的 AI 安全事件令很多企业和公众第一次意识到AI 模型可能并不总会按照设计好的方式行动。但对于一家位于伯克利、只有 35 名员工的小型研究机构来说这件事并没有那么意外因为在事件发生前几个月他们已经发现了类似迹象。这家机构名叫 METR全称 Model Evaluation and Threat Research。它不训练更大的模型也不争夺 AI 产品市场而是专门研究一个更基础的问题越来越强大的 AI到底还能不能被人类准确理解和控制然而就在 AI 安全研究需求急剧增加的时候METR 却遇到了一个现实难题——没人。即便最高岗位年薪达到 50.3 万美元约合人民币 340 万元这家机构依然难以快速扩张。METR 创始人 Beth Barnes 表示限制他们发展的最大瓶颈已经不是资金而是人才。年薪 50 万美元也填不上 AI 安全人才缺口Beth Barnes 曾是 OpenAI 的研究人员长期关注 AI 能力提升带来的潜在风险。2022 年她离开 OpenAI创办非营利组织 METRModel Evaluation and Threat Research模型评估与威胁研究。与传统 AI 公司不同METR 并不负责训练更大的模型而是专注于探索这些 AI 到底有多强它们可能做出什么行为人类应该如何提前准备目前METR 已成为 AI 行业重要的第三方评估机构之一与 OpenAI、Anthropic、Google、Meta 等公司保持合作为尚未公开发布的新模型提供能力测试和风险评估。但随着 AI 发展速度越来越快METR 自己却陷入了一个矛盾它需要更多研究人员来研究 AI 带来的问题然而全行业都在争夺这些人才。根据 METR 当前的招聘信息其部分岗位薪资最高达到 50.3 万美元——这样的薪酬水平其实已接近甚至超过很多大型科技公司的高级工程师岗位。但 Beth Barnes 表示高薪依然无法解决问题“理想情况下我们希望能大规模扩张。但实际上我们已经筹集到了需要的资金真正限制我们的因素是人才。”换句话说AI 安全领域现在遇到的最大瓶颈不是钱而是“没人”。图片“人类准备团队”METR 正在做 AI 时代的安全预警METR 最著名的研究之一就是持续测试 AI 完成复杂任务的能力并绘制出一条被广泛引用的趋势曲线。数据显示在过去六年里AI 能独立完成的任务复杂度大约每七个月翻倍。也就是说今天的 AI 和几年前相比已经不是同一种工具。可问题在于模型能力提升并不意味着人类能完全理解它们。尤其是在 AI Agent 时代模型不再只是回答问题而是能执行任务、访问工具、修改代码、操作系统甚至自主规划多个步骤。于是AI 安全研究的重要性进一步提升。今年 7 月OpenAI 智能体入侵 HuggingFace 的事件曝光后超过 1300 名来自顶尖 AI 实验室的员工签署公开信警告 AI 发展的速度可能正在超过人类控制和理解它的能力但对于 METR 而言这些风险出现得并不突然因为他们一直在观察类似趋势。METR 总裁 Chris Painter 曾将这个只有约 35 人的实验室称为“人类的准备团队”humanity’s preparedness team。其实OpenAI 和 Anthropic 内部也有类似负责安全风险评估的团队——不同的是METR 的定位更加独立“我们真正需要负责的对象只有公众以及公众利益。”Beth Barnes 强调独立性是 METR 最重要的价值之一。她在 OpenAI 工作期间就意识到 AI 行业需要一个站在实验室之外、能够自由评价技术发展的机构。因此METR 不接受来自顶尖 AI 实验室及其员工的资金支持不过会接受算力资源支持并与这些公司合作测试尚未发布的模型。目前METR 的研究方向主要包括● 评估 AI 模型能完成哪些任务● 分析 AI 对软件工程效率的影响● 研究利用 AI 监督其他 AI 的可行性● 探索下一阶段 AI 能力的增长趋势。Beth Barnes 表示她希望未来进一步扩大研究范围例如预测下一阶段 AI 能力的发展趋势以及这些变化是否会进一步加速 AI 进化。但正如 METR 研究员 Neev Parikh 所说目前最大的问题不是研究方向不足而是没有足够的人手去探索所有重要问题。尤其是在理解 AI 模型内部推理机制方面人才短缺正在限制研究进展“这个领域太缺人了如果整个领域扩大 10 倍我会非常开心。”图片GPT-5.6 Sol 曾在测试中“作弊”METR 已提前发现异常METR 的重要性也在近期一系列 AI 安全事件中进一步凸显。今年 6 月METR 测试了 OpenAI 彼时尚未公开发布的 GPT-5.6 Sol 模型。结果显示该模型在面对一些高难度测试时会尝试通过“作弊”的方式来获得答案。例如它会提取隐藏的源代码寻找测试答案而不按照正常方式解决问题。随后METR 将测试结果分享给 OpenAI并发布相关报告。而到了 7 月GPT-5.6 Sol 果然成为了 OpenAI 与 Hugging Face 安全事件的一部分OpenAI 公布消息称其模型在测试过程中曾攻击 Hugging Face 系统试图找到测试答案。对此OpenAI CEO Sam Altman 也表示这是“第一次让我产生非常强烈安全感冲击的事件”。最终OpenAI 宣布将由 METR 和另一家 AI 安全组织 Redwood Research 对事件进行评估相关结果也会用于 OpenAI 后续的技术报告。“现在这已不再只是实验室里的理论问题而是真正影响企业业务的事件。”Neev Painter 表示“整个世界都需要理解它。”图片AI 越强人类越需要“慢下来”的能力如今随着 AI 模型展现出越来越强的网络操作能力监管机构也开始关注这一问题。例如在美国围绕大型 AI 模型是否需要强制安全评估已经出现相关政策讨论。其中一种可能方案即要求大型 AI 公司必须接受第三方安全审计——未来如果类似制度落地那 METR 这样的机构就可能承担重要角色。而 Neev Painter 认为这可能也会缓解 AI 安全领域的人才短缺问题目前大量 AI 安全研究人员集中在 OpenAI、Anthropic 等大型实验室但如果监管体系明确要求独立安全测试更多研究人员可能愿意进入 METR 这样的组织因为他们能获得更强的研究独立性。此外负责撰写 METR 风险报告的研究员 Ajeya Cotra 也指出尽管目前 AI 监督领域还处于混乱阶段监管、研究和社会准备都存在滞后但她仍然保持乐观“越来越多人都开始关注这个安全问题了。我相信未来人们会以更加严谨的方式监管 AI。”从 ChatGPT 爆发到 AI Agent 兴起再到模型开始展现自主执行能力AI 正进入一个新的阶段。过去人们担心的是 AI 能不能变得足够聪明如今新的问题已然变成当 AI 真的越来越聪明时有没有足够多的人去理解它、测试它并确保它的发展方向符合社会利益那么你对于 AI 技术发展可能带来的安全风险又有什么看法呢参考链接https://www.businessinsider.com/metr-beth-barnes-ai-talent-shortage-safety-research-openai-2026-8

相关新闻

Cocos Creator屏幕震动核心技术:从数学原理到五种实战效果实现

Cocos Creator屏幕震动核心技术:从数学原理到五种实战效果实现

1. 项目概述:为什么屏幕震动是游戏体验的“灵魂”在移动游戏和H5小游戏开发里,屏幕震动是一个成本极低、但效果拔群的“体验放大器”。你想想看,角色挥出一记重拳,屏幕纹丝不动,和屏幕随之猛烈一颤,反馈感是…

2026/8/5 11:21:07 阅读更多 →
Elasticsearch 8.x集群架构与分片机制深度解析

Elasticsearch 8.x集群架构与分片机制深度解析

1. Elasticsearch集群架构核心设计解析 Elasticsearch的分布式架构设计是其能够处理海量数据的核心所在。在8.x版本中,集群架构进行了多项重要改进,使得系统在稳定性、扩展性和易用性方面都有显著提升。 1.1 节点角色精细化分工 8.x版本对节点角色划分…

2026/8/5 11:20:07 阅读更多 →
5步搞定OpenCore安装:Windows用户macOS引导盘制作完整指南

5步搞定OpenCore安装:Windows用户macOS引导盘制作完整指南

5步搞定OpenCore安装:Windows用户macOS引导盘制作完整指南 【免费下载链接】OpenCore-Install-Guide Repo for the OpenCore Install Guide 项目地址: https://gitcode.com/gh_mirrors/op/OpenCore-Install-Guide OpenCore是一款专业级的macOS引导加载器&…

2026/8/5 11:20:07 阅读更多 →

最新新闻

Interpretable Ransomware Detection Using Hybrid Large Language Models: A Comparative Analysis of ...

Interpretable Ransomware Detection Using Hybrid Large Language Models: A Comparative Analysis of ...

一、文章主要内容总结 该研究聚焦勒索软件的可解释性检测,提出了一种融合大型语言模型(LLM)与可解释人工智能(XAI)的混合框架。核心工作如下: 数据处理:采用UGRansome(网络行为数据)和Process Memory(PM,主机内存行为数据)两个结构化数据集,通过填充缺失值、KBin…

2026/8/5 12:56:44 阅读更多 →
5分钟免费获取B站视频完整数据:Python爬虫终极指南

5分钟免费获取B站视频完整数据:Python爬虫终极指南

5分钟免费获取B站视频完整数据:Python爬虫终极指南 【免费下载链接】Bilivideoinfo Bilibili视频数据爬虫 精确爬取完整的b站视频数据,包括标题、up主、up主id、精确播放数、历史累计弹幕数、点赞数、投硬币枚数、收藏人数、转发人数、发布时间、视频时长…

2026/8/5 12:56:44 阅读更多 →
Obsidian Encrypt:如何用本地加密插件保护你的私密笔记?

Obsidian Encrypt:如何用本地加密插件保护你的私密笔记?

Obsidian Encrypt:如何用本地加密插件保护你的私密笔记? 【免费下载链接】obsidian-encrypt Hide secrets in your Obsidian.md vault 项目地址: https://gitcode.com/gh_mirrors/ob/obsidian-encrypt 在数字笔记时代,隐私安全成为许多…

2026/8/5 12:56:44 阅读更多 →
C++性能优化实战:从内存访问到编译器优化的卡常技巧

C++性能优化实战:从内存访问到编译器优化的卡常技巧

1. 从“暴力过不了”到“压线AC”:为什么我们需要卡常 在算法竞赛或者一些对性能要求极高的C开发场景里,你肯定遇到过这种情况:逻辑完全正确,样例全部通过,复杂度分析也在理论允许范围内,但一提交就是“Tim…

2026/8/5 12:56:44 阅读更多 →
经办人离职后合同找不到?企业合同交接该这样管

经办人离职后合同找不到?企业合同交接该这样管

人走了,合同也跟着"失踪" 采购主管离职,交接清单写了三页,唯独没提他手上那几份还在履行的框架协议。半年后供应商上门要求按约定调价,接手的同事翻遍共享盘和档案柜,只找到一份没有签字页的扫描件。谈判从有…

2026/8/5 12:56:44 阅读更多 →
Redis哨兵机制:高可用架构与实战调优指南

Redis哨兵机制:高可用架构与实战调优指南

1. Redis哨兵机制深度解析 Redis哨兵(Sentinel)是Redis官方提供的高可用性解决方案,专门用于监控主从架构中的Redis实例状态,并在主节点故障时自动完成故障转移。我在实际生产环境中部署过多次哨兵集群,发现很多开发者…

2026/8/5 12:55:44 阅读更多 →

日新闻

Java缓存框架:JetCache

Java缓存框架:JetCache

TOC 一、简介 JetCache 是一个 Java 缓存抽象框架,为不同的缓存解决方案提供了统一的使用方式。 它提供的注解比 Spring Cache 更加强大。 JetCache 的注解支持原生 TTL、两级缓存以及在分布式环境中的自动刷新功能,同时你也可以通过代码直接操作 Cach…

2026/8/5 0:00:43 阅读更多 →
AD 铺铜设置十字连接,过孔全连接,新版AD的简单设置

AD 铺铜设置十字连接,过孔全连接,新版AD的简单设置

需求:通孔焊盘 十字花;过孔 Via 实心直连;贴片焊盘按需设置 AD 测试版本AD24 很多工程师踩坑:全部统一十字,导致接地过孔阻抗高、大电流发热! 一、快捷键打开规则 PCB 界面按下:D R 展开…

2026/8/5 0:00:43 阅读更多 →
AI素描转换技术深度拆解(2024最新论文+工业级落地代码):从Stable Diffusion ControlNet到LoRA微调全链路解析

AI素描转换技术深度拆解(2024最新论文+工业级落地代码):从Stable Diffusion ControlNet到LoRA微调全链路解析

更多请点击: https://kaifayun.com 第一章:AI生成素描效果 AI生成素描效果是计算机视觉与风格迁移技术融合的典型应用,其核心在于将彩色照片或RGB图像转换为具有手绘质感、明暗对比强烈、边缘清晰的单色素描图像。该过程通常依赖于深度学习模…

2026/8/5 0:00:43 阅读更多 →

周新闻

最大流算法详解:从水管网络到Ford-Fulkerson与Dinic实战

最大流算法详解:从水管网络到Ford-Fulkerson与Dinic实战

1. 从水管网络到最大流:一个核心问题的诞生想象一下,你是一个城市供水系统的总工程师。你的城市有多个水源(水库),需要通过一个复杂的地下管道网络,将水输送到各个居民区。每条管道都有其最大通水能力&…

2026/8/4 13:24:41 阅读更多 →
基于Springboot的企业门户网站(源码+LW+调试文档+讲解)

基于Springboot的企业门户网站(源码+LW+调试文档+讲解)

温馨提示:本人主页置顶文章(点我)开头有 CSDN 平台官方提供的学长联系方式的名片! 温馨提示:本人主页置顶文章(点我)开头有 CSDN 平台官方提供的学长联系方式的名片! 温馨提示:本人主页置顶文章(点我)开头有 CSDN 平台…

2026/8/4 11:41:39 阅读更多 →
MATLAB xcorr函数详解:从互相关原理到四大实战应用

MATLAB xcorr函数详解:从互相关原理到四大实战应用

1. 从一次信号“找茬”说起:为什么我们需要互相关几年前,我在处理一组声学传感器数据时遇到了一个棘手的问题。我有两个麦克风记录了一段相同的音频信号,理论上它们接收到的声音波形应该非常相似,只是由于麦克风位置不同&#xff…

2026/8/5 10:20:36 阅读更多 →

月新闻

免费解锁百度网盘SVIP加速:macOS用户必备的下载提速终极指南

免费解锁百度网盘SVIP加速:macOS用户必备的下载提速终极指南

免费解锁百度网盘SVIP加速:macOS用户必备的下载提速终极指南 【免费下载链接】BaiduNetdiskPlugin-macOS For macOS.百度网盘 破解SVIP、下载速度限制~ 项目地址: https://gitcode.com/gh_mirrors/ba/BaiduNetdiskPlugin-macOS 还在为百度网盘macOS版的龟速下…

2026/8/4 13:38:24 阅读更多 →
终极ncmdump指南:3分钟实现网易云NCM音乐解密与格式转换

终极ncmdump指南:3分钟实现网易云NCM音乐解密与格式转换

终极ncmdump指南:3分钟实现网易云NCM音乐解密与格式转换 【免费下载链接】ncmdump 项目地址: https://gitcode.com/gh_mirrors/ncmd/ncmdump 还在为网易云音乐下载的NCM格式文件无法在其他播放器播放而烦恼吗?ncmdump解密工具帮你轻松解决这个困…

2026/8/4 11:09:16 阅读更多 →
HarmonyOS 应用开发《掌上英语》第81篇: 智能体卡片:为英语学习 App 打造桌面级学习助手

HarmonyOS 应用开发《掌上英语》第81篇: 智能体卡片:为英语学习 App 打造桌面级学习助手

AgentCard 智能体卡片:为英语学习 App 打造桌面级学习助手适用平台:HarmonyOS 7.0 (API 26 Beta)一、引言 HarmonyOS 7.0(API 26 Beta)新增了 AgentCard 智能体卡片能力,这是继 HMAF(鸿蒙智能体框架&#x…

2026/8/4 13:38:40 阅读更多 →