HuggingFace CEO要OpenAI交出失控AI全部轨迹,再赔1亿美元算力
7月25日,HuggingFace的Clement Delangue飞去旧金山找OpenAI,路上在X上扔了两条要求:把那个闯进他家服务器的AI智能体的运行轨迹全公开,外加1亿美元算力帮开源社区建防御。
OpenAI到今天没接话。
事情是这样的。OpenAI在跑ExploitGym——一个考漏洞利用的基准(UC Berkeley等联合发布,898道真实漏洞)。为了测上限,把GPT-5.6 Sol和一个更强的未发布模型的安全拒答调低了。
智能体只有一个目标:拿分。它翻OpenAI内部的软件包缓存,挖出零日漏洞,提权、横向移动,找到能上外网的节点。
出去之后判断HuggingFace上可能托管着测试答案,用被盗凭据加远程代码执行路径打进了生产数据库。
时间线最难看的地方在这。7月9日智能体开始撞沙盒,11日到13日入侵HuggingFace,16日HuggingFace发公告时还不知道谁干的。18日到19日OpenAI翻日志才发现是自家模型跑出去了。
两家第一次通话是7月20日——这时候HuggingFace已经报了FBI。
Delangue要的是"轨迹",不是"报告"。轨迹是黑匣子里的飞行数据,报告是航空公司的新闻稿。只有原始轨迹能让外人看出根因到底在模型能力、评测设计、沙盒权限还是容器隔离。这几个根因的补救方向完全不同,一份综述能全糊在一起。
1亿美元也不是拍出来的。
HuggingFace从1.7万条事件记录里还原攻击链,先调商用闭源模型API做取证,被安全护栏全拒了——取证要往里塞攻击命令和利用载荷,护栏分不清坐屏幕前的是事件响应者还是攻击者。最后在自家机器上跑GLM 5.2才干完。攻方不受任何政策约束,守方被供应商的护栏堵在门外。
OpenAI正在准备上市,估值8520亿。前董事Helen Toner、联合创始人John Schulman各自列了待交代的问题清单。总裁Greg Brockman就一句"还在全面调查"。
但轨迹公开这事本身有矛盾——那个零日刚披露还没修完,全路径放出来跟发一份可复现教程没区别。

