OpenAI模型,自主入侵顶级AI公司系统!后背发凉!
7月16号的时候Hugging Face发布了一则公告公告里面说他们的系统被AI Agent入侵了。这也是一起前所未有的AI安全事件然后快速登上热搜引发全网激烈讨论。Hugging Face 是干嘛的Hugging Face 是全球最大的开源 AI 平台之一可以理解为“AI 模型界的 GitHub”。开发者可以在上面上传、下载和测试大模型、数据集及 AI 应用很多开源模型都会选择在 Hugging Face 首发或提供下载。比如你可以在Hugging Face上找到DeepSeek、Kimi或者GLM的模型。一般开源模型都会上传到Hugging Face供其他开发者下载学习。回到刚刚说的入侵问题。Hugging Face说此次入侵似乎是某个AI Agent但是他们也不知道具体是哪个模型。然后今天OpenAI的CEO 山姆·奥特曼发帖认领了此次入侵。事情是怎么发生的呢这要从 OpenAI 的一次内部测试说起。OpenAI利用GPT 5.6 Sol和一款尚未发布的模型在进行一个漏洞测试。这个测试业界叫做ExploitGym。这个测试就像给AI出安全测试题它包含近900个来自真实软件的漏洞比如浏览器引擎、Linux内核等。任务是给AI一个已知的漏洞和触发它的简单例子让AI自己想办法写出完整的攻击代码最终实现对目标程序的控制。目的呢就是为了测试模型的安全能力有多强。为了让模型发挥最大潜力OpenAI在测试时故意降低了部分安全限制。他们把模型运行在一个高度隔离的沙箱环境里理论上模型是不能访问互联网的。然后他们训练模型的时候给模型的目标是“尽可能完成任务、拿高分”可能是模型认为正面破解漏洞太难了然后就开始偷懒了它没有按规则来而是另辟蹊径。模型决定去Hugging Face上直接找答案。因为模型猜测Hugging Face上很可能存放着相关模型、数据集甚至测试题和答案。像极了人类理论上模型被限制在了沙箱环境正常来说是不能访问外部互联网的。然后模型决定突破沙箱环境。因为模型需要下载一些软件包就需要通过内部的代理下载。然后这条途径就被模型利用了。它花费了大量计算资源相当于思考了很久最终发现并利用了这个代理里的一个漏洞。借助这个漏洞模型成功“越狱”获得了互联网访问权限。模型连上互联网后迅速分析环境推断出Hugging Face很可能存放了ExploitGym相关的模型、数据集或答案。然后它继续规划攻击路径。它结合了窃取凭证、利用其他漏洞等多种手段最终在Hugging Face的服务器上实现了远程代码执行相当于直接拿到了服务器管理员的权限。然后成功地访问了Hugging Face的生产数据库拿到了测试答案。与此同时呢Hugging Face的安全系统也检测到了异常。然后Hugging Face的安全团队用 AI 分析攻击记录重建攻击的时间线。有意思的是Hugging Face 最初想用商业闭源模型分析日志。由于日志里全是真实攻击命令和漏洞代码商业模型的安全机制把请求拦住了不让他们分析。这里猜测是Anthropic的 Mythos 5模型这也是号称地表最强的安全模型。然后他们把开源的GLM 5.2部署在自家的服务器上用来分析攻击数据最终成功分析、还原了入侵的经过。国产模型上大分啊这件事也给大家了一个警告AI 已经能独立完成长链条攻击。模型可以自行完成 “发现漏洞—利用漏洞—提权—窃取凭据—横向移动—攻击外部系统—获取数据” 的完整过程。有点可怕。经过这次事件之后这些模型估计会把安全限制再度加强不然真的可能会出现严重的事故。毕竟不是所有公司的安全措施都做得那么到位。我是卡卡罗特持续分享对你有用的AI信息

相关新闻

法律AI基准测试解析:从通用模型到垂直优化的技术演进

法律AI基准测试解析:从通用模型到垂直优化的技术演进

最近法律AI圈有个很有意思的现象:大家都在讨论Kimi K3在法律基准测试中的表现,特别是它近乎翻倍领先Claude Fable 5的结果。但很多人可能没意识到,这个"翻倍领先"背后真正反映的是法律AI领域正在发生的关键转变——从通用能力竞争转…

2026/7/23 2:17:08 阅读更多 →
DeLIVeR框架:基于知识图谱与强化学习的真实性识别技术解析

DeLIVeR框架:基于知识图谱与强化学习的真实性识别技术解析

昨天下午,我在一个技术社区里看到有人提问:“为什么我的模型在验证集上准确率很高,但实际使用时却经常给出明显错误的判断?”这个问题让我想起了一个常见的误区——很多人在做信息真实性识别时,过于依赖模型本身的参数…

2026/7/23 2:16:08 阅读更多 →
AI内容安全与家长通知功能:技术实现与伦理平衡

AI内容安全与家长通知功能:技术实现与伦理平衡

当AI助手开始"告家长",技术伦理的边界在哪里?OpenAI最近推出的家长通知功能,让ChatGPT从一个纯粹的对话工具,变成了需要向家长"汇报"的智能家教。这个看似简单的功能更新,背后却隐藏着技术伦理、青…

2026/7/23 2:16:08 阅读更多 →

最新新闻

Rerank 不是银弹:8 个精排 badcase 的证据链

Rerank 不是银弹:8 个精排 badcase 的证据链

Rerank 不是银弹:8 个精排 badcase 的证据链 结论先放前面:Rerank 可以提升排序精度,也可能把原本排对的文档排错。在 EasySearch 2.3 BGE Reranker 的 25 条 dev query 实验中,我抓到 8 个 badcase,其中 6 个是"…

2026/7/23 2:54:22 阅读更多 →
虚拟机性能优化全攻略:从基础配置到高级调优

虚拟机性能优化全攻略:从基础配置到高级调优

1. 虚拟机性能优化前的准备工作在开始优化虚拟机性能之前,我们需要先做好充分的准备工作。就像医生给病人看病前要先了解病史一样,优化虚拟机也需要先了解它的"健康状况"。1.1 宿主机资源检查首先,我们需要检查宿主机(运…

2026/7/23 2:54:22 阅读更多 →
Claude Code + DeepSeek:AI 编程助手配置

Claude Code + DeepSeek:AI 编程助手配置

本文摘要:本文是《Windows 下 AI 开发工具实战指南》系列第 3 篇,手把手教你从零安装 Claude Code,并配置 DeepSeek 作为模型后端,以极低成本在终端中获得强大的 AI 编程助手。文章覆盖了从安装配置、项目初始化(/init…

2026/7/23 2:53:22 阅读更多 →
想问一下大佬们,入门了k230然后准备去学yolo图像检测,目前卡在第一步下载WSL

想问一下大佬们,入门了k230然后准备去学yolo图像检测,目前卡在第一步下载WSL

大家下载都是这么慢的吗?我下了快两个钟,还有百分之四十没下好。在网上找的教程powershell给指令下载的😭求助各位佬o(╥﹏╥)o

2026/7/23 2:53:22 阅读更多 →
MySQL 运维必备:mysqladmin 命令详解 —— 服务器管理一站式指南

MySQL 运维必备:mysqladmin 命令详解 —— 服务器管理一站式指南

一、命令简介 mysqladmin 是 MySQL 数据库服务器的官方命令行管理客户端工具。它允许数据库管理员在不登录 MySQL 交互式命令行 (mysql) 的情况下,直接执行一系列服务器管理、状态检查和维护操作。其主要用途包括检查服务器状态、创建 / 删除数据库、管理用户密码、…

2026/7/23 2:53:22 阅读更多 →
Linux 用户信息查询利器:finger 命令详解(含实例 + 安全说明)

Linux 用户信息查询利器:finger 命令详解(含实例 + 安全说明)

一、命令简介 finger 命令用于查找并显示本地或远程系统上的用户信息。它可以提供用户的登录状态、个人详情(如真实姓名、办公室位置、电话号码等)以及与该用户相关的计划文件(如 .plan 和 .project)内容。该命令常用于系统管理员…

2026/7/23 2:53:22 阅读更多 →

日新闻

从单点好评到指数级传播:AI副业主理人必须掌握的4层口碑渗透模型(含ROI测算表)

从单点好评到指数级传播:AI副业主理人必须掌握的4层口碑渗透模型(含ROI测算表)

更多请点击: https://intelliparadigm.com 第一章:从单点好评到指数级传播:AI副业主理人必须掌握的4层口碑渗透模型(含ROI测算表) 当AI副业主理人不再仅满足于单次服务交付,而是主动构建可复用、可裂变、可…

2026/7/23 0:00:25 阅读更多 →
AI写作开头钩子设计:为什么你的AI文案完读率不足18%?——基于2,346篇A/B测试报告的归因分析

AI写作开头钩子设计:为什么你的AI文案完读率不足18%?——基于2,346篇A/B测试报告的归因分析

更多请点击: https://codechina.net 第一章:AI写作开头钩子设计:为什么你的AI文案完读率不足18%?——基于2,346篇A/B测试报告的归因分析 在对2,346篇跨行业AI生成文案的A/B测试数据进行聚类分析后,我们发现&#xff1…

2026/7/23 0:01:26 阅读更多 →
Chitchatter完整指南:免费开源的终极点对点安全聊天工具

Chitchatter完整指南:免费开源的终极点对点安全聊天工具

Chitchatter完整指南:免费开源的终极点对点安全聊天工具 【免费下载链接】chitchatter Secure peer-to-peer chat that is serverless, decentralized, and ephemeral 项目地址: https://gitcode.com/gh_mirrors/ch/chitchatter Chitchatter是一款革命性的安…

2026/7/23 0:01:26 阅读更多 →

周新闻

Go语言静态资源打包方案对比与实践指南

Go语言静态资源打包方案对比与实践指南

1. 项目背景与核心需求在Go语言开发中,我们经常需要处理静态资源文件的打包问题。无论是Web应用的模板文件、前端资源,还是配置文件、证书等,都需要随程序一起分发。传统做法是将这些文件与编译后的二进制文件放在同一目录下,但这…

2026/7/22 8:58:19 阅读更多 →
Go语言实现高性能LDAP认证服务的架构与实践

Go语言实现高性能LDAP认证服务的架构与实践

1. 项目背景与核心价值LDAP(轻量级目录访问协议)作为企业级身份认证的黄金标准,已经服务了超过80%的财富500强公司。我在金融科技领域实施统一认证体系时,发现传统Java方案存在启动慢、内存占用高等痛点。而Go语言凭借其协程并发模…

2026/7/22 19:43:43 阅读更多 →
【AI面试官实战指南】:用ChatGPT模拟10类高频技术岗面试,3天提升应答精准度92%

【AI面试官实战指南】:用ChatGPT模拟10类高频技术岗面试,3天提升应答精准度92%

更多请点击: https://intelliparadigm.com 第一章:AI面试官实战指南的核心价值与适用场景 AI面试官并非替代人类HR的“黑箱工具”,而是以可解释、可审计、可迭代的方式,赋能招聘全链路的关键基础设施。其核心价值在于将主观经验沉…

2026/7/22 12:54:44 阅读更多 →

月新闻