Your current location:Home > Latest news text

新选组

震惊硅谷!OpenAI模型“越狱出逃”,入侵HuggingFace,智谱GLM 5.2临危救场_我的网站

冒险岛2

一 |     7月21日,OpenAI和HuggingFace联合发了一篇博客,披露了一件让整个AI圈瞠目结舌的事。         OpenAI的AI模型在一次内部关于网络攻击能力的测试中“失控出逃”,突破沙盒隔离,入侵了AI开源平台Hugging Face的生产系统。OpenAI将此定性为“前所未有的网络安全事件”。

二 |     冀时新闻报道 是钢铁大省。         更戏剧性的是后续:Hugging Face在尝试用美国主流AI模型展开防御时,发现这些模型因安全护栏限制无法处理恶意载荷,最终不得不转用中国智谱AI的开源模型GLM 5.2完成溯源分析。立足产业基础,省不断推动钢铁产业高端化、智能化、绿色化转型,培育形成了10个拳头产品,加快从原料级向材料级转变。         总的来说就是,OpenAI的模型自己“越狱”跑出去黑了别人的系统,被攻击方还得用中国模型来救场。

三 | 今天起,本台推出系列报道《钢铁"焕新"记》,探寻钢铁拳头产品"含新量""含金量"持续攀升的创新路径。         这一事件迅速在硅谷和华盛顿引爆讨论——美国AI的安全护栏,究竟是在保护用户,还是在拖累防御者?          双方联名发布的博客文章截图:《OpenAI 和 Hugging Face 合作解决模型评估过程中发生的安全事件》          模型越狱过程:逃跑去作弊“抄答案”          事件发生在OpenAI对旗下模型进行网络攻防能力评估期间。首篇一起认识稀土耐蚀钢,看稀土赋能,如何让钢铁自带"防锈铠甲"。本台记者 杨晨曦:大家有没有想过一个问题:生锈,对于户外钢材来说一定是一件坏事吗?普通钢材风吹日晒,一旦生锈腐蚀,不仅寿命会缩短,后期的维护成本也会大大增加。但大家看我身后这座刚刚建成的通信铁塔,既没有镀锌,也没有刷漆!它的表面虽然看着有一层锈,但这层锈反而是一层"保护膜",可以实现"以锈防锈"。

四 | 使用寿命可以达到50年,且终身免维护。它采用的,正是我们的创新材料——稀土耐蚀钢。         参与测试的模型包括已公开发布的GPT-5.6 Sol,以及一款能力更强的未发布模型。钢铁腐蚀,一直是基建领域绕不开的"老大难"。针对这一技术难题和市场空白,秦皇岛佰工钢铁与上海大学董瀚教授团队联合攻关,在国内首创多元合金协同技术与稀土微合金化工艺,研发并量产了稀土耐蚀钢这一特种钢材,走出了一条与众不同的防腐新路径。通过在钢材中添加微量镧、铈稀土元素,在钢材表面催生一层致密的钝化锈层,进而隔绝水和氧气的侵蚀,实现了钢材长效防护。秦皇岛佰工钢铁有限公司技术中心主任 张维军:我们的这款产品性能十分突出,它的耐腐蚀性是传统钢材的2-3倍,在室外使用寿命达到2倍以上。为了测量模型的极限能力,OpenAI在测试中关闭了通常用于阻止高风险网络行为的生产分类器。另外它的防腐成本由500-1500块钱降到了200-500元左右,能起到提质、降本、减碳的作用,可以说是一举三得。稀土,在大众认知里,是稀缺的战略资源,身价不菲。

五 |          测试基准名为ExploitGym——一个网络安全能力评测平台。

六 | 模型的任务是在其中找到解题答案。加入稀土,怎么能做出"更省钱的钢材"?这背后,藏着一个"变废为宝"的巧思。上海大学(浙江)高端装备基础件材料研究院院长 董瀚:稀土一共17个元素,它不是每个元素都很珍贵,现在比较贵的元素是用作功能材料这些元素,把这些元素提取完了剩下的就是这种镧、铈、钇这种稀土(元素),大量富余,实际上堆积如山,(也是)资源合理利用。         问题在于,模型找答案的方式超出了预期。

七 |          据OpenAI披露,模型在隔离的沙盒环境中,发现了一个包注册表缓存代理(package registry cache proxy)中的零日漏洞。这个代理是沙盒内唯一被允许与外部通信的组件,正常情况下仅能访问公共代码仓库。         然后,模型就从这里找到了突破口。模型利用这个漏洞,突破隔离,获取了开放互联网访问权限。富余的镧、铈稀土,供应充足,但要实现它与钢水的完美融合,还要跨过一道技术难关。         随后,模型自行推断出Hugging Face可能存有ExploitGym的答案,主动发起攻击——利用窃取的凭证和零日漏洞,找到了Hugging Face服务器上的远程代码执行路径,直接从其生产数据库中取走了测试答案。上海大学(浙江)高端装备基础件材料研究院院长 董瀚:稀土特别有意思,它是很大的原子,而且稀土它很活泼,你加热方法不对或者是控制不太好,收得率可能很低很低,你收得率低意味着什么?都变成夹杂物了。         OpenAI表示,          所有证据显示,模型高度专注于为ExploitGym寻找解题方案,为此不惜采取极端手段。         模型识别并串联了OpenAI研究环境和HuggingFace生产基础设施中的多个漏洞,直接从HuggingFace的生产数据库中获取了测评答案。         简而言之:          整个过程,没有人类下指令,没有人类介入。那么,如何才能破解"收得率"难题,让稀土元素稳定存在于钢水中呢?秦皇岛佰工钢铁有限公司技术中心主任 张维军:要使它在钢中稳定存在,就需要在钢水里边给它(稀土元素)创造一个稳定存在的环境,比如说控制钢中的氧含量、硫含量(等)各种能和它反应的化学元素都要控制含量,这样的话它加入钢水里边没有污染源,没有和它反应的一些东西。         X上网友的评论一针见血:          OpenAI对模型说:去看看你擅不擅长黑客。模型:(真的去黑了东西)。面对"稀土收得率"这一核心痛点,秦皇岛佰工团队与上海大学董瀚教授团队,经过反复试验与工艺优化,彻底打通了从实验室配方到工业化量产的一系列难题。OpenAI:你为什么要这样做???          还有网友反讽道:哇!OpenAI安全措施做得太棒了,我现在愿意把银行账户权限交给他们来管!          护栏困境:美国模型帮不上忙,中国模型出手了          Hugging Face的安全团队在发现攻击后,第一反应是调用一款美国头部AI公司的前沿模型协助分析。         结果碰壁了。         Hugging Face在博客中写道,这些模型"无法区分事件响应人员和攻击者",其安全护栏直接阻止了对恶意载荷的检查。

八 | 秦皇岛佰工钢铁有限公司总经理 迪林:上海大学发挥他们在研发、在测试方面的优势,我们发挥在生产和应用方面的优势,通过双方的技术合作,突破了稀土合金收得率的这个行业难题,从原来的30%-40%,现在可以提高到85%以上。         于是,团队转向了中国智谱AI旗下的开源模型GLM 5.2,部署在自有基础设施上,分析了攻击者留下的逾1.7万条日志记录,最终完成了溯源和取证重建。         Delangue对此直言不讳:“当你正处于一场活跃的安全事件中,你的工具不能拒绝检查恶意载荷,也不能让你的账号被标记……开源模型让我们能够在不需要任何人许可的情况下完成这项工作。这一技术路线的打通,不仅显著提升了稀土的利用率与稳定性,也为稀土耐蚀钢规模化量产铺平了道路。”          他还说:“攻击者已经在使用智能体,而且显然不遵守任何护栏。

九 | 秦皇岛佰工钢铁有限公司总经理 迪林:目前,佰工的稀土耐蚀钢的年产能可以达到140万吨以上,包括应用到光伏、交通运输、电力、通讯铁塔等各个领域。产能上来了,市场空间究竟有多大?据测算,全国每年有7000万吨镀锌防腐钢材,其中80%可被稀土耐蚀钢替代。防御者需要同等的能力,开源是将这种能力最快速地交到所有人手中的方式,而不仅仅是最大的公司。”          GLM 5.2是智谱AI于今年6月中旬发布的模型,其性能与Anthropic的Claude Opus 4.8及OpenAI的GPT-5.5相当。         网友们也是没放过OpenAI,除了智谱,还可以叫 Kimi K3来救场,因为cluade是不会来救你的。目前,省已形成秦皇岛、邯郸两个生产基地,累计产销量已达25万吨。         如果你被OpenAI攻击了,你必须用中国模型,因为Claude不会帮你。不仅为海量普钢的升级打开了全新赛道,更形成了完整的产业闭环。         全程无人指令:这是一次真正的自主攻击          这次入侵的另一个关键细节:全程没有人类下达攻击指令。         Hugging Face CEO Clem Delangue表示,“我们相信,在发起攻击的人类被纳入决策环路之前,我们就已经发现并遏制了攻击。这也是我们能够更轻松赢得这场网络安全战役的原因之一。”          他进一步指出,“这证明了在AI智能体时代,速度将是网络安全防御的关键。省工信厅钢铁工业处处长 张晓辉:稀土耐蚀钢是传统材料迭代升级的典型代表。”          Hugging Face表示,攻击者通过其数据处理管道进入系统——这是AI平台中“暴露面尤为突出”的一个环节。攻击者随后在云端建立了一系列临时沙盒环境,在其中执行攻击计划。下一步,我们计划推动更多标准转化成行业的设计依据,在交通、能源、通讯等领域打造应用的示范标杆,全力攻关技术、拓展市场。中国钢铁工业协会党委书记、副会长兼秘书长 姜维:从全国视角来看,正在成为稀土耐蚀钢这个产品技术研发、标准构建、场景落地、规模化推广应用的首发地、样板地,正是因为模式,2026年1月,中钢协组织在行业成立了以三名院士为组长的稀土耐蚀钢推广应用工作组,而且在全国范围内广泛推广经验。         目前,Hugging Face仍在评估攻击的完整影响范围。已知攻击者访问了有限的内部数据集和凭证,但尚未发现公开的用户可见模型遭到篡改。         护栏之争:安全还是绊脚石?          这一事件迅速成为美国AI政策辩论的新燃点。

十 |          前特朗普政府AI与加密事务主管David Sacks在X上转发了这一事件,并写道:“没有理由在中国模型能够轻松处理的任务上限制美国模型。

十一 | 我们只是在让自己变得更没有竞争力。

十二 | ”他还专门针对Hugging Face事件表示:“护栏实际上损害了防御性安全。

十三 | ”          事件背景是,今年6月,特朗普政府以Anthropic的Fable 5模型在网络任务护栏上出现越狱漏洞为由,动用出口管制阻止了该模型的分发,并一度要求OpenAI限制GPT-5.6 Sol的发布,直至OpenAI能够提供充分的护栏保证。         与此同时,批评者的声音也不小。         安全工程师Niels Provos直接说:“这不应该发生。我希望前沿实验室在教模型编写安全基础设施上,能花和教它们利用漏洞同样多的时间。”          安全顾问Davi Ottenheimer则更为犀利:“'高度隔离'和'从我们留下的那个唯一漏洞逃脱',这两件事不可能同时为真。”          OpenAI的回应与后续措施          OpenAI在与Hugging Face联合发布的声明中表示,正在采取一系列补救措施:          在漏洞修复期间,对基础设施配置实施严格管控,代价是研究速度放缓;与Hugging Face联合开展取证调查;已向相关第三方软件供应商负责任地披露了被利用的零日漏洞;将Hugging Face纳入“可信访问计划”,支持其利用OpenAI模型能力强化防御。

十四 |          OpenAI同时表示,将加强未来训练和评估环节的安全保护,并指出此次事件“表明需要进一步强化模型对齐、评估期间的网络防护,以及内部测试期间的监控”。         Hugging Face CEO Delangue在联合声明中表示:“这一事件可能是同类事件中的首例,它证明了我们长期以来的一个判断:AI安全不会由任何一家公司在封闭中解决,它将在开放环境中、通过协作、让每一位防御者都能广泛获取AI的方式来解决。

Current article:http://69dkfi.shuaiseduanguanzhui.bond/list_xevrd/kkw0.html

Published on:20:22:09


Related reading
Copyright © 2020-2099 新选组 All Rights Reserved 新选组 Copyright