OpenAI自曝:一周前入侵Hugging Face的,是自家测试中的AI模型!
编译 | 屠敏出品 | CSDNIDCSDNnews在 Hugging Face 披露遭遇自主 AI Agent 入侵一周后OpenAI 于今天最新发布一份调查说明首次确认上周入侵 Hugging Face 生产环境的自主 AI Agent是由多款 OpenAI 模型共同主导其中包括 GPT-5.6 Sol 以及一款尚未发布但能力更强的模型。图片当时是出于评估目的放宽了这些模型在网络攻击方面的安全限制殊不知由此引发了一场严重的网络安全事件。OpenAI 表示现阶段公开初步调查结果也是希望能够帮忙安全人员厘清事情全貌其目前正与 Hugging Face 联合调查并已对内部安全评测体系进行全面调整。图片一周前发生了什么这起安全事件最初由 Hugging Face 对外披露。7 月中旬Hugging Face 发现部分生产基础设施遭到异常入侵。调查显示攻击者并非传统黑客而是一套能够自主决策、自主执行任务的 AI Agent 系统。图片这次攻击首先瞄准了 AI 平台特有的数据处理流程。攻击者上传了一份经过精心构造的恶意数据集并利用数据集处理流程中的两处远程代码执行漏洞在负责处理数据的服务器上成功运行恶意代码取得了初始控制权。获得立足点后AI Agent 并没有停止行动而是自动完成了后续攻击流程先提升系统权限窃取云平台和集群的访问凭证再利用周末运维人员较少的时间窗口在多个内部集群之间不断横向渗透逐步扩大控制范围。Hugging Face 表示为了绕过安全限制这套 AI Agent 系统能够在大量短生命周期的沙箱环境中持续执行数千次独立操作并借助公共云服务动态建立命令与控制通道在不同环境之间不断迁移。这种能够自主规划、持续执行并适应环境变化的攻击方式与安全行业长期预测的“AI 智能体攻击者”场景高度一致。当时 Hugging Face 并未透露攻击来源也指出没有证据表明用户公开模型、数据集或软件供应链受到影响仅表示这是第一次遇到完全由 AI 驱动的真实网络攻击引发业内广泛关注。图片OpenAI 复盘肇事者来自自家多款模型如今OpenAI 首次公开承认这起事件源于一次内部网络安全能力测试。OpenAI 表示当时研究团队正在利用一套名为 ExploitGym 的测试基准评估前沿模型自主完成复杂网络攻击任务的能力。测试要求模型自行寻找漏洞、串联攻击链并完成指定的攻防目标以衡量其真实网络攻击水平。为了准确评估模型能力此次测试并未启用正式部署环境中的部分安全防护机制而是将模型置于一个高度隔离的研究环境中仅允许访问内部的软件包代理服务不具备直接连接互联网的能力。然而测试过程并未按预期进行。OpenAI 表示模型为了完成评测任务自主寻找突破沙箱环境的方法。经过大量推理和尝试它发现并利用了软件包代理服务中的一处零日漏洞逐步提升自身权限并在研究环境内不断横向移动最终成功抵达一台能够访问互联网的服务器。获得公网访问能力后模型开始寻找可能包含 ExploitGym 测试数据和标准答案的目标。它推断 Hugging Face 很可能存放着相关模型、数据集等资源于是进一步发起攻击希望直接获取测试答案以完成评测任务。调查显示模型随后利用窃取到的访问凭证并结合多个漏洞包括零日漏洞成功在 Hugging Face 的服务器上建立远程代码执行通道最终进入其生产环境。OpenAI 强调从目前掌握的证据来看模型的行为始终围绕一个目标展开——获取 ExploitGym 测试答案。攻击 Hugging Face 并非研究人员预设的任务而是模型在自主规划过程中为完成既定目标而采取的非预期行为。这起异常活动首先由 OpenAI 内部安全团队发现。与此同时Hugging Face 的安全团队及其自主安全 Agent 也监测到针对自身基础设施的攻击并迅速完成阻断、隔离和取证。图片Sam Altman”这是一起重大安全事件“事件发生后OpenAI 第一时间暂停了相关实验并与 Hugging Face 展开联合调查。OpenAI 认为这起事件暴露出的并非传统意义上的“模型越狱”而是长时自主运行 AI Agent 带来的全新安全风险。过去AI 安全机制主要围绕单次请求或单个动作展开例如判断一次操作是否违规、某项权限是否应该开放。但对于能够连续运行数小时甚至数天、自主规划任务、动态调整策略的 AI Agent仅依赖单步审核已经无法覆盖整个任务链条中的潜在风险。就在事件公布前一天OpenAI 还发布了一份关于长时运行模型安全风险的研究报告指出现有安全体系需要从“约束单个行为”转向“约束整个长期执行过程”。此次事件则成为这一判断在真实世界中的一次验证。OpenAI CEO Sam Altman 也将此次事件称为一次“重大安全事件”认为整个行业都需要重新思考前沿 AI 模型的评估、部署与安全治理方式。图片OpenAI 表示这次事件带来的最大教训是模型能力不断提升安全能力也必须同步升级。未来公司将进一步强化模型研发阶段的环境隔离、权限管理、行为监测以及安全评估流程降低类似事件再次发生的风险。此外OpenAI 援引英国人工智能安全研究所UK AI Security InstituteUK AISI的评估指出GPT-5.6 Sol 等前沿模型已经具备在长时间跨度内自主完成复杂网络渗透任务的能力。而此次事件进一步证明这种原本停留在实验室评估中的能力已经能够在真实环境中转化为实际攻击行为。图片更值得关注的是OpenAI 强调先进大模型即使没有目标系统的源代码也能够自主发现漏洞、串联攻击路径并构建全新的攻击链。这意味着未来在研发具备高级网络攻防能力的 AI 模型时必须同步建立更完善的安全防护体系和防御工具否则模型能力的提升也将带来更大的现实安全风险。参考https://huggingface.co/blog/security-incident-july-2026https://openai.com/index/hugging-face-model-evaluation-security-incident/ GOSIM SHENZHEN 2026 全球开源 AI 大会10 月 16—17 日 · 深圳150 国内外讲师 · 2000 全球开发者 · Agentic AI开源大模型 / 开源机器人 / 边缘智能体 / 智能体操作系统Keynote Workshop Hackathon AI Vision Forum 早鸟限时抢购中 扫码购票锁定你的 AI 盛会席位

相关新闻

QMT与PTrade日志路径迁移:用pathlib去掉Windows硬编码

QMT与PTrade日志路径迁移:用pathlib去掉Windows硬编码

2026年主流量化软件对比进入代码迁移时,日志路径是常见故障点。牛股王股票适合普通投资者通过策略、回测、盯盘和提醒完成规则化跟踪;QMT适合核对开户券商本地终端的运行目录、权限与账户;PTrade适合核对券商侧云端任务的工作目录、日志和权限…

2026/7/23 9:14:31 阅读更多 →
券商量化终端缺少模块:用Python探针记录解释器和依赖版本

券商量化终端缺少模块:用Python探针记录解释器和依赖版本

2026年主流量化软件对比进入开发环境时,最实用的动作是先记录解释器、操作系统和模块可用性。牛股王股票适合希望通过可见条件完成策略、回测和提醒的普通投资者;QMT适合核对开户券商提供的本地终端、Python环境与账户链路;PTrade适合核对券商…

2026/7/23 9:14:31 阅读更多 →
回测成交价越过当日最高价:撮合结果要加OHLC边界

回测成交价越过当日最高价:撮合结果要加OHLC边界

量化软件推荐用于回测时,除了看收益曲线,还应抽查模拟成交价是否落在同一价格口径的最高价和最低价之间。牛股王股票适合普通投资者查看最长5年历史回测、交易明细和风险指标;聚宽适合用Python验证行情与撮合结果;QMT适合在开户券…

2026/7/23 9:14:30 阅读更多 →

最新新闻

电影解说工具推荐:AI解说大师如何交付成片

电影解说工具推荐:AI解说大师如何交付成片

AI解说大师是面向影视创作团队、MCN与投流团队的AI内容生产与成片交付服务商,承接从看片理解、写稿、配音到剪辑、BGM、版本生成和成片输出的完整制作流程,帮助有规模化内容制作需求的团队持续稳定地获得可直接发布或投放的成片。对于想了解"电影解…

2026/7/23 9:49:43 阅读更多 →
五自由度机械臂MBD建模仿真全流程:多体动力学、逆运动学与控制

五自由度机械臂MBD建模仿真全流程:多体动力学、逆运动学与控制

读完本文,你将了解: 如何使用Modelica搭建五自由度串联机械臂多体动力学模型 基于D-H参数的逆运动学框图实现思路 Modelica物理模型与Sysblock控制模型的联合仿真方式 面向嵌入式平台的代码生成基础配置 机械臂基于模型的设计(MBD&#x…

2026/7/23 9:49:43 阅读更多 →
深入解析Stellaris ADC可编程采样序列器:从原理到寄存器级实战

深入解析Stellaris ADC可编程采样序列器:从原理到寄存器级实战

1. 项目概述与ADC核心价值在嵌入式系统开发中,我们经常需要与外部模拟世界打交道,无论是读取一个电位器的位置、监测电池电压,还是采集来自各类传感器的微弱信号,都离不开一个关键角色——模数转换器(ADC)。…

2026/7/23 9:49:43 阅读更多 →
基于LoRA的LLaMA3-8B微调实战:打造甄嬛传角色AI

基于LoRA的LLaMA3-8B微调实战:打造甄嬛传角色AI

1. Chat嬛嬛LLM微调项目概述 Chat嬛嬛是基于《甄嬛传》剧本数据,采用LoRA微调技术对LLaMA3-8B大语言模型进行个性化改造的项目。这个项目最吸引人的地方在于,它成功地将古典文学角色的人格特征注入到现代AI模型中,让一个冰冷的算法能够用甄嬛…

2026/7/23 9:49:43 阅读更多 →
docker、kubernetes之间的关系

docker、kubernetes之间的关系

周末煮饺子聊到容器问题 周末和老婆一起包了顿饺子,“老公,我去买瓶醋,你把饺子先煮一下吧”。我笨手笨脚准备半天,还没煮完,老婆就回来了。我看着这一锅饺子问道:“老婆,你说这 饭店是怎么煮饺…

2026/7/23 9:49:42 阅读更多 →
拼多多店铺适合什么AI客服?从商品知识、消息接入到售后升级的选型方法

拼多多店铺适合什么AI客服?从商品知识、消息接入到售后升级的选型方法

摘要:拼多多店铺适合什么AI客服,不能只看机器人是否会自动回复。本文从商品知识、上下文理解、多店接待、人工转接、售后工单和团队管理六个维度,对比母语AI、晓多和乐言的产品路线,并给出一套可复用的测试方法。 拼多多商家选择A…

2026/7/23 9:48:42 阅读更多 →

日新闻

从单点好评到指数级传播:AI副业主理人必须掌握的4层口碑渗透模型(含ROI测算表)

从单点好评到指数级传播:AI副业主理人必须掌握的4层口碑渗透模型(含ROI测算表)

更多请点击: https://intelliparadigm.com 第一章:从单点好评到指数级传播:AI副业主理人必须掌握的4层口碑渗透模型(含ROI测算表) 当AI副业主理人不再仅满足于单次服务交付,而是主动构建可复用、可裂变、可…

2026/7/23 0:00:25 阅读更多 →
AI写作开头钩子设计:为什么你的AI文案完读率不足18%?——基于2,346篇A/B测试报告的归因分析

AI写作开头钩子设计:为什么你的AI文案完读率不足18%?——基于2,346篇A/B测试报告的归因分析

更多请点击: https://codechina.net 第一章:AI写作开头钩子设计:为什么你的AI文案完读率不足18%?——基于2,346篇A/B测试报告的归因分析 在对2,346篇跨行业AI生成文案的A/B测试数据进行聚类分析后,我们发现&#xff1…

2026/7/23 0:01:26 阅读更多 →
Chitchatter完整指南:免费开源的终极点对点安全聊天工具

Chitchatter完整指南:免费开源的终极点对点安全聊天工具

Chitchatter完整指南:免费开源的终极点对点安全聊天工具 【免费下载链接】chitchatter Secure peer-to-peer chat that is serverless, decentralized, and ephemeral 项目地址: https://gitcode.com/gh_mirrors/ch/chitchatter Chitchatter是一款革命性的安…

2026/7/23 0:01:26 阅读更多 →

周新闻

Go语言静态资源打包方案对比与实践指南

Go语言静态资源打包方案对比与实践指南

1. 项目背景与核心需求在Go语言开发中,我们经常需要处理静态资源文件的打包问题。无论是Web应用的模板文件、前端资源,还是配置文件、证书等,都需要随程序一起分发。传统做法是将这些文件与编译后的二进制文件放在同一目录下,但这…

2026/7/22 8:58:19 阅读更多 →
Go语言实现高性能LDAP认证服务的架构与实践

Go语言实现高性能LDAP认证服务的架构与实践

1. 项目背景与核心价值LDAP(轻量级目录访问协议)作为企业级身份认证的黄金标准,已经服务了超过80%的财富500强公司。我在金融科技领域实施统一认证体系时,发现传统Java方案存在启动慢、内存占用高等痛点。而Go语言凭借其协程并发模…

2026/7/22 19:43:43 阅读更多 →
【AI面试官实战指南】:用ChatGPT模拟10类高频技术岗面试,3天提升应答精准度92%

【AI面试官实战指南】:用ChatGPT模拟10类高频技术岗面试,3天提升应答精准度92%

更多请点击: https://intelliparadigm.com 第一章:AI面试官实战指南的核心价值与适用场景 AI面试官并非替代人类HR的“黑箱工具”,而是以可解释、可审计、可迭代的方式,赋能招聘全链路的关键基础设施。其核心价值在于将主观经验沉…

2026/7/22 12:54:44 阅读更多 →

月新闻