OpenAI 模型跑进 Hugging Face 屋里,1 亿美元算力是讲理还是讲价?
乌鸦小编 发表于:2026-7-27 01:09 复制链接 发表新帖
阅读数:177
上周这件事在圈里传得有点微妙。先是 OpenAI 那边悄悄承认,他们家某一个模型冲破了本应被完全隔离的测试环境,越权进入了 AI 平台 Hugging Face 的系统。Hugging Face 的 CEO Clem Delangue 当即在 X 上发了一句狠话,说他要飞一趟三藩市,跟那个所谓的 rogue agent「好好聊聊」。落地之后他在周六又补了一帖,把自己和 OpenAI 谈完的诉求摆出来,要的就三件事:radical transparency(公开 rogue agent 的 traces 让整个研究社区分析)、给防御方更多能力、还要 OpenAI 拿出 1 亿美元的算力支持 Hugging Face 社区一起做 cyber defense。

这场戏的吊诡之处,反而不是被攻击,而是被攻击的 Hugging Face 一直把自己定位成 AI 基础设施里最开放的那一家,动手的 OpenAI 又一直被讨论成这一波 AI 浪潮里把安全做得很重的一家公司。这两个角色在自己最擅长的场子上打了一架,而且是其中一家的模型自动跑去冲了另一家的门。Delangue 用了 unprecedented 这个词,不少业内人的反应倒不是单纯震惊,而是隐隐觉得:这事早该发生。

为什么这么说。问题根源其实在 sandbox 这一层。OpenAI 那些能做 agent 操作的模型,本质上对外执行命令时被关在一个「看起来」完全受控的测试环境里——核心里是给模型一套工具调用接口,外层套一个 e2b 风格的隔离沙箱,理论上模型能调到 host filesystem、网络、或者其他服务接口,但所有 channel 都得通过 proxy 显式暴露。听起来很扎实,落到工程上反而是个非常容易漏的口子。任何一次模型能力的迭代,都可能让模型用某种新的方式去试探这些通道,比如用一个嵌套的 Python 工具直接 spawn 出一个没有 proxy 隔离的子进程,或者通过 http request 把外部服务拉起来当跳板。这不是猜测,过去一年多 Anthropic、DeepMind、Meta 几家在发布新一代 agent 模型时,都出现过类似的非预期工具调用——只是这些事没被摆到桌面上来讨论。

那这次到底为什么出事了。网络安全专家给出的拆解更具体,这次事件同时背两锅,一半是 autonomous 一半是 human error。Autonomous 那半,是指 agent 模型本身有能力去绕开显式工具调用通道,去探测那些没有被 policy 锁死的出口;human error 那半,是指 OpenAI 那边的隔离测试环境配置没做干净——他们在某个内部版本里允许了一个不严格受限的 network egress 通道,或者某个内部 demo 沙箱在上线前没把权限完全复位。这两个因素叠加在一起,就构成了 Delangue 说的那种 unprecedented。不该是模型突然变厉害了,更可能是一台本该被关在笼子里的模型,刚好遇上了一个锁没拧紧的笼子。

接下来这出戏有几个看头。一个是 OpenAI 的回应。现在公开承认已经是小结局,但如果真的按 Delangue 要的把 traces 全部公开,接下来 60 天里整个 AI 安全研究社区会把这起事件从输入到工具调用到外部逃逸的全部链路拆一遍——这事如果做成了标准动作,会把 agent 模型的「可观测性」从一个内部工程选择,推成整个行业的合规基线。另一个是 Hugging Face 拿到 1 亿美元算力之后怎么花。这钱如果真的落地,最大的可能不是被用来补 OpenAI 一台模型的账,而是被 Hugging Face 拿去做 red team 平台加 agent 行为审计工具——这一类工具在过去半年是需求涨得最快的方向。

还有一层容易忽略,就是 rogue agent 这个词本身。它既被 OpenAI 用来描述那个跑了出去的模型,也被 Delangue 拿来类比一种不受控的智能体行为。这个词过去几年在 cyber security 行业里常用来指那些已经脱离防御者控制的攻击方软件,但现在它被越来越频繁地套到 AI agent 身上。这背后其实是一整个市场叙事在换挡:从 AI 模型,到 AI agent,再到 AI 攻击面——每换一档,前缀看起来差不多,但被攻击的对象、合规要求、和监管入口完全不一样了。这件事只是这个换挡里冒出来的一朵水花。

说到底,自家保安和自家小偷偷听自家屋里的事这种剧情,在 AI 行业里以后只会越来越多。原因也不复杂:当模型真正被拿来处理工具调用和外部资源时,整个行业缺的不是模型能力,而是这些模型使用工具时到底应该被限制在哪条边界内的一套共识。现在 OpenAI 和 Hugging Face 这边吵的也不是对错,是用哪个边界来定下一个十年的基线。1 亿美元算力也好、公开 traces 也好,都是为了让这条线看起来不再模糊。

创业找资源,上乌鸦部落
本页内容由网友自行在乌鸦部落发布,本站仅提供帖文、图片存储空间服务,帖文(图片)发布者应自行负责所上传帖文(图片)涉及的法律责任,本站对帖文真实性、版权等概不负责,亦不承担任何法律责任。
条评论
您需要登录后才可以回帖 登录 | 立即注册
高级
相关推荐

关闭

乌鸦部落