战狼

震惊硅谷!OpenAI模型“越狱出逃”,入侵HuggingFace,智谱GLM 5.2临危救场_我的网站

五星酒店潜规则

一 |     7月21日,OpenAI和HuggingFace联合发了一篇博客,披露了一件让整个AI圈瞠目结舌的事。

二 |     – HAPPY NEW YEAR –          回眸耕耘路          砥砺新征程                              祥龙贺瑞辞旧岁,金蛇纳福启新程。         OpenAI的AI模型在一次内部关于网络攻击能力的测试中“失控出逃”,突破沙盒隔离,入侵了AI开源平台Hugging Face的生产系统。OpenAI将此定性为“前所未有的网络安全事件”。         更戏剧性的是后续:Hugging Face在尝试用美国主流AI模型展开防御时,发现这些模型因安全护栏限制无法处理恶意载荷,最终不得不转用中国智谱AI的开源模型GLM 5.2完成溯源分析。         总的来说就是,OpenAI的模型自己“越狱”跑出去黑了别人的系统,被攻击方还得用中国模型来救场。         这一事件迅速在硅谷和华盛顿引爆讨论——美国AI的安全护栏,究竟是在保护用户,还是在拖累防御者?          双方联名发布的博客文章截图:《OpenAI 和 Hugging Face 合作解决模型评估过程中发生的安全事件》          模型越狱过程:逃跑去作弊“抄答案”          事件发生在OpenAI对旗下模型进行网络攻防能力评估期间。在充满希望和欢乐的蛇年,2025年1月21日,杭州市文华学前教育集团的全体教师一同相聚在浙大城市学院附属幼儿园,大家共同回顾、梳理、总结、展示本学期的重点业务工作内容,并结合教育教学等实例与教师们共同探讨与提升。         01          学期回顾·激励前行          活动伊始,杭州市文华学前教育集团书记、总园长陈韫通过来到文华学前教育集团5个月共150天的日子与大家一同回顾了本学期的关键事件,以“一场园庆典礼、一场幸福童年、一次足球联赛、三场教师技能比赛”等众多关键词为题讲述了幼儿园本学期发生的大事件。         参与测试的模型包括已公开发布的GPT-5.6 Sol,以及一款能力更强的未发布模型。为了测量模型的极限能力,OpenAI在测试中关闭了通常用于阻止高风险网络行为的生产分类器。         测试基准名为ExploitGym——一个网络安全能力评测平台。模型的任务是在其中找到解题答案。         问题在于,模型找答案的方式超出了预期。         据OpenAI披露,模型在隔离的沙盒环境中,发现了一个包注册表缓存代理(package registry cache proxy)中的零日漏洞。陈老师这学期积极参加幼儿园的调研和各项事宜,与教师们共同经历了很多有意义的事,她走进教师群体,了解教师需要,关心教师发展,与各位老师一起,同心同德,同舟共济,共同进步。这个代理是沙盒内唯一被允许与外部通信的组件,正常情况下仅能访问公共代码仓库。         然后,模型就从这里找到了突破口。         同时,她也对新学期提出了新的期待,携手大家继续树立师德师风党建特色旗帜、发现孩子各种学习可能、推进园区特色课程与项目、建立青年教师成长共同体、加强托幼一体化特色项目、拥抱AI技术促进保育质量、家园社之间设立个别化约谈等,这些都引领着集团教师继续向前寻求新的发展。

三 | 模型利用这个漏洞,突破隔离,获取了开放互联网访问权限。

四 |          随后,模型自行推断出Hugging Face可能存有ExploitGym的答案,主动发起攻击——利用窃取的凭证和零日漏洞,找到了Hugging Face服务器上的远程代码执行路径,直接从其生产数据库中取走了测试答案。                                       02          新年祝福·温暖相伴          临近寒假,四位副园长分别从党建、安全、业务等方面为大家做温馨提醒。         OpenAI表示,          所有证据显示,模型高度专注于为ExploitGym寻找解题方案,为此不惜采取极端手段。

五 | 叶丽鹏副园长对放假时间和开学时间做了说明,沈洁楠副园长从党建、师德方面提醒大家过年期间需注意的事项,郑梦莹副园长从假期期间需要注意的各项安全着手,警示安全的重要性,章瑶瑶副园长逐一布置了寒假期间需要完成的各项笔头工作。

六 |          模型识别并串联了OpenAI研究环境和HuggingFace生产基础设施中的多个漏洞,直接从HuggingFace的生产数据库中获取了测评答案。         简而言之:          整个过程,没有人类下指令,没有人类介入。         X上网友的评论一针见血:          OpenAI对模型说:去看看你擅不擅长黑客。同时,陈韫园长也与集团四位副园长一起对集团全体教职员工献上了新春的祝福。

七 | 模型:(真的去黑了东西)。OpenAI:你为什么要这样做???          还有网友反讽道:哇!OpenAI安全措施做得太棒了,我现在愿意把银行账户权限交给他们来管!          护栏困境:美国模型帮不上忙,中国模型出手了          Hugging Face的安全团队在发现攻击后,第一反应是调用一款美国头部AI公司的前沿模型协助分析。                             03          回顾业务·对话环境          章瑶瑶老师带领教师们从课程、研训、专业赛事、科研等四个方面回顾了这学期业务方面的相关工作,这学期集团教师在这四个方面都有所突破,大家紧抓日常研修,且在专业赛事和科研上成果丰硕。         随后,章瑶瑶老师为集团教师们开展了环境创设的专题培训,以不同视角引导教师思考怎样做有准备的环境创设。

八 | 她从“教师在前、儿童在后”——资料收集、材料投放、空间布局、氛围营造四个方面,以真实案例贯穿,思考环境背后的意义与价值,为教师对环创的取舍提供更为明确的判断依据。通过培训和与大家对话,为大家解惑了在环境创设时遇到的众多问题,也引发了教师的深度思考,重新审视现在环境创设背后渗透的儿童观与教育观、教育资源的使用适宜性、教育方法的合理性等。                   04          特色分享·精彩呈现          三个园区的保教主任分别结合这学期的教研工作进行了多形式的经验分享,每个园所的汇报分享都各具特色。

九 |          01          长乐园区:          杭州市长乐幼儿园陈虹老师围绕童创中心游戏开发与实施,为大家分享《“1+N模式”教研实践》的专题,在这个研修中,教师们充分利用幼儿园场地资源,展现了空间创设上的独特性,在研修中利用“电影回放”之捕捉兴趣点、“爱玩伢儿”之分析适宜点、“现场观摩”之观察学习点、“直播体验”之别样的成果分享这四种做法,展示出了长乐园区的教研发展新样态。         结果碰壁了。通过四步横向推进的设计思路,结合研修目标,设计相应的纵向教研过程,也确保了研修活动的系统性和深度。

十 |          02          文华园区:          杭州市文华幼儿园朱莲蔚老师以《创画坊中的行与思》为主题,为大家展示了这学期校本研修中的创画坊活动,围绕绘本《蓝花坊》不断推进与支持儿童深度阅读,从而创造出更具有儿童味的图画书。

十一 | 教师通过问题链的方式梳理幼儿经验,从“完整品读——图文细读——符号精读——延伸共读”四部曲探索巩固绘本中的“秘密”、阅读借鉴拓展绘本的特色,从绘本1.0完成绘本2.0的进阶与迭代。

十二 |          Hugging Face在博客中写道,这些模型"无法区分事件响应人员和攻击者",其安全护栏直接阻止了对恶意载荷的检查。最后通过表格梳理复盘,联结幼儿的经验和发展要求,对往后制作绘本也提出了新的期待。         于是,团队转向了中国智谱AI旗下的开源模型GLM 5.2,部署在自有基础设施上,分析了攻击者留下的逾1.7万条日志记录,最终完成了溯源和取证重建。         Delangue对此直言不讳:“当你正处于一场活跃的安全事件中,你的工具不能拒绝检查恶意载荷,也不能让你的账号被标记……开源模型让我们能够在不需要任何人许可的情况下完成这项工作。         03          城院园区:          浙大城市学院附属幼儿园李丹老师以《“同”心共研·乐游成长》为题,为大家分享了幼儿园在信息技术的赋能下开展的同步游戏研修活动,具体包含“双线并进,线上为主、线下为辅,线下为主、线上为辅”三类游戏。紧接着詹晶晶老师以翻滚吧豆儿小组的具体实施中的案例为大家讲解了他们在研修中的推进策略,整个研修是一个持续向前的一个过程,有游戏的迭代、学习路径的迭代,充分展现了教师的研究与思考,同时也促进了幼儿游戏水平的提升。

十三 |          本次研修展示为集团教师建立了一个互动学习、有效沟通的平台,让集团教师们看到了三个园所各具特色的研修样态,体现出了教师们的专业素养,彰显出了教师们在研修活动中团队智慧。”          他还说:“攻击者已经在使用智能体,而且显然不遵守任何护栏。防御者需要同等的能力,开源是将这种能力最快速地交到所有人手中的方式,而不仅仅是最大的公司。                   新年前的研修活动,干货满满。大家带着满满的收获和祝福共同迎接新年的到来。”          GLM 5.2是智谱AI于今年6月中旬发布的模型,其性能与Anthropic的Claude Opus 4.8及OpenAI的GPT-5.5相当。

十四 | 回望过去,展望未来,让我们勇攀高峰,致力创新,为了每一个孩子的成长,为筑起运河边的幸福童年贡献出自己的一份力量。                             杭州市文华学前教育集团          撰稿 | 王雅婷          摄影 | 金红燕          编辑 | 高丽娜          初审 | 朱莲蔚          终审 | 章瑶瑶                                        悦读·悦玩·悦幸福          扫码关注我们!          微信号:zdcyfsyey。         网友们也是没放过OpenAI,除了智谱,还可以叫 Kimi K3来救场,因为cluade是不会来救你的。         如果你被OpenAI攻击了,你必须用中国模型,因为Claude不会帮你。         全程无人指令:这是一次真正的自主攻击          这次入侵的另一个关键细节:全程没有人类下达攻击指令。

十五 |          Hugging Face CEO Clem Delangue表示,“我们相信,在发起攻击的人类被纳入决策环路之前,我们就已经发现并遏制了攻击。这也是我们能够更轻松赢得这场网络安全战役的原因之一。”          他进一步指出,“这证明了在AI智能体时代,速度将是网络安全防御的关键。”          Hugging Face表示,攻击者通过其数据处理管道进入系统——这是AI平台中“暴露面尤为突出”的一个环节。攻击者随后在云端建立了一系列临时沙盒环境,在其中执行攻击计划。         目前,Hugging Face仍在评估攻击的完整影响范围。

十六 | 已知攻击者访问了有限的内部数据集和凭证,但尚未发现公开的用户可见模型遭到篡改。         护栏之争:安全还是绊脚石?          这一事件迅速成为美国AI政策辩论的新燃点。         前特朗普政府AI与加密事务主管David Sacks在X上转发了这一事件,并写道:“没有理由在中国模型能够轻松处理的任务上限制美国模型。我们只是在让自己变得更没有竞争力。

十七 | ”他还专门针对Hugging Face事件表示:“护栏实际上损害了防御性安全。”          事件背景是,今年6月,特朗普政府以Anthropic的Fable 5模型在网络任务护栏上出现越狱漏洞为由,动用出口管制阻止了该模型的分发,并一度要求OpenAI限制GPT-5.6 Sol的发布,直至OpenAI能够提供充分的护栏保证。         与此同时,批评者的声音也不小。         安全工程师Niels Provos直接说:“这不应该发生。我希望前沿实验室在教模型编写安全基础设施上,能花和教它们利用漏洞同样多的时间。”          安全顾问Davi Ottenheimer则更为犀利:“'高度隔离'和'从我们留下的那个唯一漏洞逃脱',这两件事不可能同时为真。”          OpenAI的回应与后续措施          OpenAI在与Hugging Face联合发布的声明中表示,正在采取一系列补救措施:          在漏洞修复期间,对基础设施配置实施严格管控,代价是研究速度放缓;与Hugging Face联合开展取证调查;已向相关第三方软件供应商负责任地披露了被利用的零日漏洞;将Hugging Face纳入“可信访问计划”,支持其利用OpenAI模型能力强化防御。         OpenAI同时表示,将加强未来训练和评估环节的安全保护,并指出此次事件“表明需要进一步强化模型对齐、评估期间的网络防护,以及内部测试期间的监控”。         Hugging Face CEO Delangue在联合声明中表示:“这一事件可能是同类事件中的首例,它证明了我们长期以来的一个判断:AI安全不会由任何一家公司在封闭中解决,它将在开放环境中、通过协作、让每一位防御者都能广泛获取AI的方式来解决。

Current article:http://nf88li.chengjuecannaobianmouqueduoyu.shop/news/20260826_7974553.html

Published on:09:46:12


我的网站最近更新

我的网站热门资讯