新闻频道>新政风向

震惊硅谷!OpenAI模型“越狱出逃”,入侵HuggingFace,智谱GLM 5.2临危救场_我的网站

来源: 新华社
11:21:14

飓风营救

震惊硅谷!OpenAI模型“越狱出逃”,入侵HuggingFace,智谱GLM 5.2临危救场_我的网站

最完美的离婚

A |     能识别猫、狗等宠物情绪并翻译为人类语言的全球首款实时宠物翻译器PettiChat,可实现3秒速热与远红外理疗功能的石墨烯发热眼罩……近日,2026杭州十大“科技新特产”及20项入围产品、杭州科技旅游新二十景公布。

B |     7月21日,OpenAI和HuggingFace联合发了一篇博客,披露了一件让整个AI圈瞠目结舌的事。

C | 余杭入选总数达14项,居全市第一。余杭区委十五届十四次全体会议明确,要以“创新余杭”建设推动新质生产力发展,全力打造人工智能创新发展第一城核心承载地。         OpenAI的AI模型在一次内部关于网络攻击能力的测试中“失控出逃”,突破沙盒隔离,入侵了AI开源平台Hugging Face的生产系统。OpenAI将此定性为“前所未有的网络安全事件”。         更戏剧性的是后续:Hugging Face在尝试用美国主流AI模型展开防御时,发现这些模型因安全护栏限制无法处理恶意载荷,最终不得不转用中国智谱AI的开源模型GLM 5.2完成溯源分析。         总的来说就是,OpenAI的模型自己“越狱”跑出去黑了别人的系统,被攻击方还得用中国模型来救场。         这一事件迅速在硅谷和华盛顿引爆讨论——美国AI的安全护栏,究竟是在保护用户,还是在拖累防御者?          双方联名发布的博客文章截图:《OpenAI 和 Hugging Face 合作解决模型评估过程中发生的安全事件》          模型越狱过程:逃跑去作弊“抄答案”          事件发生在OpenAI对旗下模型进行网络攻防能力评估期间。余杭正以创新为魂,推动越来越多的科创成果从“书架”走上“货架”、走向全球。

D |          参与测试的模型包括已公开发布的GPT-5.6 Sol,以及一款能力更强的未发布模型。创新驱动 激活源头活水在余杭区未来科技城超重力实验大楼里,全省首个国家大科学装置杭州超重力场能够模拟超过地球重力千百倍的“超重力场”,在科研上实现“时空压缩”的“超能力”,让科研效率实现了质的飞跃。为了测量模型的极限能力,OpenAI在测试中关闭了通常用于阻止高风险网络行为的生产分类器。         测试基准名为ExploitGym——一个网络安全能力评测平台。在余杭,像这样的创新载体已多点绽放:人工智能小镇在这里扎下了根;四大实验室等高能级创新平台先后落地;“模域空间”启用,已集聚约120家企业与200家OPC(一人公司)……共同为余杭的创新生态注入强劲动能。平台是舞台,企业才是主角。模型的任务是在其中找到解题答案。         问题在于,模型找答案的方式超出了预期。通过构建“省科技型中小企业—国家高新技术企业—新雏鹰企业—‘小巨人’企业—科技领军企业”全层级培育矩阵,余杭集聚了越来越多的“高成长性”企业集群。在“杭州六小龙”中余杭占其一,“杭州新八骏”中余杭占其三。在2026全球人工智能大会上,智澄首发的AI全尺寸双足人形机器人TR6、曦诺未来的Flex 2灵巧手等一系列AI成果让世界再次看见余杭的创新实力。接下来,余杭将继续加大科技领军企业、高新技术企业、专精特新“小巨人”、制造业单项冠军、独角兽企业等培育力度,努力构建“龙头引领、梯次跟进、活力迸发”的企业创新矩阵;同时,深入推进环科创平台创新生态圈建设,布局一批中试基地和概念验证中心,让更多“从0到1”的原创突破加速走向“从1到100”的规模化应用。         据OpenAI披露,模型在隔离的沙盒环境中,发现了一个包注册表缓存代理(package registry cache proxy)中的零日漏洞。算力筑基 夯实硬核底座对于人工智能企业来说,算力是驱动创新的核心引擎。在这方面,余杭的做法很实在:每年安排最高各5000万元的“算力券”和“模型券”,在全市率先上线Token券,有效降低中小企业的AI研发成本,让企业敢用算力、愿用模型。接下来,余杭将持续优化算力券、模型券、Token券、语料券等政策工具,加快形成覆盖AI研发全链条的要素保障体系。这个代理是沙盒内唯一被允许与外部通信的组件,正常情况下仅能访问公共代码仓库。

E | 算力问题解决后,在哪里训练?今年3月,海纳数据枢纽创新中心(杭州)项目在余杭正式启动,为企业提供“一站式”的语料生产、模型训练和开发服务。         然后,模型就从这里找到了突破口。目前,余杭备案登记大模型有31个,备案数量占全省近三分之一。模型利用这个漏洞,突破隔离,获取了开放互联网访问权限。         随后,模型自行推断出Hugging Face可能存有ExploitGym的答案,主动发起攻击——利用窃取的凭证和零日漏洞,找到了Hugging Face服务器上的远程代码执行路径,直接从其生产数据库中取走了测试答案。         OpenAI表示,          所有证据显示,模型高度专注于为ExploitGym寻找解题方案,为此不惜采取极端手段。

F |          模型识别并串联了OpenAI研究环境和HuggingFace生产基础设施中的多个漏洞,直接从HuggingFace的生产数据库中获取了测评答案。         简而言之:          整个过程,没有人类下指令,没有人类介入。

G |          X上网友的评论一针见血:          OpenAI对模型说:去看看你擅不擅长黑客。余杭将建设更多类似“中国飞谷”“模域空间”的创新载体,持续完善海纳数据枢纽创新中心等新型基础设施,进一步夯实人工智能产业发展的底座。模型:(真的去黑了东西)。

H | OpenAI:你为什么要这样做???          还有网友反讽道:哇!OpenAI安全措施做得太棒了,我现在愿意把银行账户权限交给他们来管!          护栏困境:美国模型帮不上忙,中国模型出手了          Hugging Face的安全团队在发现攻击后,第一反应是调用一款美国头部AI公司的前沿模型协助分析。在人工智能领域,余杭将强化“模芯协同”“芯机联动”,做强RISC-V开源生态,加快建设聚焦AI芯片、车规级芯片、具身智能终端先进封测中试基地,形成全栈式、系统化的人工智能产业竞争力。         结果碰壁了。         Hugging Face在博客中写道,这些模型"无法区分事件响应人员和攻击者",其安全护栏直接阻止了对恶意载荷的检查。AI赋能 重塑千行百业人工智能的真正意义不是“炫技”,而是要走出实验室、融入产业链,变成“有用”。         于是,团队转向了中国智谱AI旗下的开源模型GLM 5.2,部署在自有基础设施上,分析了攻击者留下的逾1.7万条日志记录,最终完成了溯源和取证重建。在高特新能源的“未来工厂”里,电池管理系统的生产线正在经历一场变革。

I |          Delangue对此直言不讳:“当你正处于一场活跃的安全事件中,你的工具不能拒绝检查恶意载荷,也不能让你的账号被标记……开源模型让我们能够在不需要任何人许可的情况下完成这项工作。”          他还说:“攻击者已经在使用智能体,而且显然不遵守任何护栏。

J | 防御者需要同等的能力,开源是将这种能力最快速地交到所有人手中的方式,而不仅仅是最大的公司。

K | ”          GLM 5.2是智谱AI于今年6月中旬发布的模型,其性能与Anthropic的Claude Opus 4.8及OpenAI的GPT-5.5相当。“我们在工厂内搭载了先进装备制造技术和新一代信息技术,通过建设数字化研发设计、智能化柔性生产、绿色低碳制造等多个核心应用场景,系统性优化了研发试制、智能制造、订单交付、经营管控等多业务链条。

L |          网友们也是没放过OpenAI,除了智谱,还可以叫 Kimi K3来救场,因为cluade是不会来救你的。”高特新能源相关负责人说。         如果你被OpenAI攻击了,你必须用中国模型,因为Claude不会帮你。         全程无人指令:这是一次真正的自主攻击          这次入侵的另一个关键细节:全程没有人类下达攻击指令。

M | AI赋能下,余杭还要打出一张具备全球辨识度的文化名片。         Hugging Face CEO Clem Delangue表示,“我们相信,在发起攻击的人类被纳入决策环路之前,我们就已经发现并遏制了攻击。打开余杭的地图,“两廊一轴”的格局清晰可见:北边是良渚文化大走廊,南边是城西科创大走廊,一条千年发展轴把“文化”和“科技”连在了一起。这也是我们能够更轻松赢得这场网络安全战役的原因之一。

N | 位于余杭区的杭州娃娃鱼动画是一家影视动画企业。”          他进一步指出,“这证明了在AI智能体时代,速度将是网络安全防御的关键。

o | ”          Hugging Face表示,攻击者通过其数据处理管道进入系统——这是AI平台中“暴露面尤为突出”的一个环节。

p | 攻击者随后在云端建立了一系列临时沙盒环境,在其中执行攻击计划。过去做一部动画,制作流程长、成本高。如今,公司培训年轻人使用AI工具,对接短剧、漫剧平台的剧本资源,两周就能用AI完成一部短剧从剧本到成片的完整流程。         目前,Hugging Face仍在评估攻击的完整影响范围。

q | 接下来,余杭将加强文化创新创造,统筹推进“文化+科技”“文化+旅游”“文化+民生”,持续推动文化建设“八项工程”在余杭走深走实。已知攻击者访问了有限的内部数据集和凭证,但尚未发现公开的用户可见模型遭到篡改。         护栏之争:安全还是绊脚石?          这一事件迅速成为美国AI政策辩论的新燃点。         前特朗普政府AI与加密事务主管David Sacks在X上转发了这一事件,并写道:“没有理由在中国模型能够轻松处理的任务上限制美国模型。我们只是在让自己变得更没有竞争力。

r | ”他还专门针对Hugging Face事件表示:“护栏实际上损害了防御性安全。”          事件背景是,今年6月,特朗普政府以Anthropic的Fable 5模型在网络任务护栏上出现越狱漏洞为由,动用出口管制阻止了该模型的分发,并一度要求OpenAI限制GPT-5.6 Sol的发布,直至OpenAI能够提供充分的护栏保证。         与此同时,批评者的声音也不小。         安全工程师Niels Provos直接说:“这不应该发生。我希望前沿实验室在教模型编写安全基础设施上,能花和教它们利用漏洞同样多的时间。

s | ”          安全顾问Davi Ottenheimer则更为犀利:“'高度隔离'和'从我们留下的那个唯一漏洞逃脱',这两件事不可能同时为真。”          OpenAI的回应与后续措施          OpenAI在与Hugging Face联合发布的声明中表示,正在采取一系列补救措施:          在漏洞修复期间,对基础设施配置实施严格管控,代价是研究速度放缓;与Hugging Face联合开展取证调查;已向相关第三方软件供应商负责任地披露了被利用的零日漏洞;将Hugging Face纳入“可信访问计划”,支持其利用OpenAI模型能力强化防御。         OpenAI同时表示,将加强未来训练和评估环节的安全保护,并指出此次事件“表明需要进一步强化模型对齐、评估期间的网络防护,以及内部测试期间的监控”。         Hugging Face CEO Delangue在联合声明中表示:“这一事件可能是同类事件中的首例,它证明了我们长期以来的一个判断:AI安全不会由任何一家公司在封闭中解决,它将在开放环境中、通过协作、让每一位防御者都能广泛获取AI的方式来解决。

Current article:http://0hucd.zhouangnaoguangsundianzhenmou.cfd/list_ment/oym.html

Published on:17:34:38


关键词:魂,战狼,回魂夜责任编辑:石邓