{主关键词}

A | 小小消防员 安全伴我行 有一种“超级英雄” 他们个个身怀绝技、出手不凡 他们意志坚定、无惧无畏 他们有一个最美的名字—— “火焰蓝” 在孩子们眼中, 消防车是会奔跑的“大红侠”, 消防员是无所不能的超级英雄。 7月21日,OpenAI和HuggingFace联合发了一篇博客,披露了一件让整个AI圈瞠目结舌的事。 为了让这份崇敬转化为 实用的知识与宝贵的经验, 我们组织了一场消防站研学体验活动, 为孩子们开启一段 意义非凡的成长之旅。 01 探秘消防车:移动的消防城堡 消防站里, 一辆辆消防车犹如威风凛凛的巨兽, 瞬间抓住了孩子们的目光。 OpenAI的AI模型在一次内部关于网络攻击能力的测试中“失控出逃”,突破沙盒隔离,入侵了AI开源平台Hugging Face的生产系统。OpenAI将此定性为“前所未有的网络安全事件”。 消防员叔叔化身“超级讲解员”, 用童趣满满的语言 介绍着不同消防车的神奇功能。 孩子们的眼睛里闪烁着好奇的光芒, 小手轻轻触摸着车上的各种装备, 仿佛在和这些“消防卫士” 进行一场无声的对话。 更戏剧性的是后续:Hugging Face在尝试用美国主流AI模型展开防御时,发现这些模型因安全护栏限制无法处理恶意载荷,最终不得不转用中国智谱AI的开源模型GLM 5.2完成溯源分析。 云梯消防车伸展长长的臂膀, 仿佛能触摸天际, 孩子们乘坐着云梯, 眼中满是惊叹, 想象着消防员叔叔乘坐云梯 冲向高空救援的英勇模样。 总的来说就是,OpenAI的模型自己“越狱”跑出去黑了别人的系统,被攻击方还得用中国模型来救场。 孩子们邂逅了 超酷的消防坦克与无人机, 它们就像来自未来的救援英雄。 这一事件迅速在硅谷和华盛顿引爆讨论——美国AI的安全护栏,究竟是在保护用户,还是在拖累防御者? 双方联名发布的博客文章截图:《OpenAI 和 Hugging Face 合作解决模型评估过程中发生的安全事件》 模型越狱过程:逃跑去作弊“抄答案” 事件发生在OpenAI对旗下模型进行网络攻防能力评估期间。 参与测试的模型包括已公开发布的GPT-5.6 Sol,以及一款能力更强的未发布模型。 孩子们仰望着它们, 眼中满是好奇与憧憬, 这些神奇的装备, 正在他们幼小的心灵种下 勇敢与探索的种子。 02 消防技能大赏:速度与勇气的较量 最让孩子们兴奋不已的, 当属穿上消防服。 厚重的消防服一上身, 孩子们瞬间化身为“小小消防员”, 虽然衣服略显沉重, 但他们小脸上却洋溢着自豪与坚毅。 这一刻, 他们真切地感受到了 消防员叔叔肩负的责任与使命, 明白了在每一次英勇救援背后, 是不为人知的艰辛与付出。为了测量模型的极限能力,OpenAI在测试中关闭了通常用于阻止高风险网络行为的生产分类器。 测试基准名为ExploitGym——一个网络安全能力评测平台。 消防员叔叔的精彩技能演示, 让孩子们大开眼界。模型的任务是在其中找到解题答案。 问题在于,模型找答案的方式超出了预期。 只见他们如闪电般迅速地爬上云梯, 在高空中如履平地, 轻松地完成各种救援动作。 这些精彩的瞬间, 不仅让孩子们看到了 消防员叔叔们高超的专业技能, 更让他们感受到了 消防员们在训练中所付出的 努力和汗水。 每一个迅速的动作、 每一次精准的操作, 都是无数次刻苦训练的结果。 据OpenAI披露,模型在隔离的沙盒环境中,发现了一个包注册表缓存代理(package registry cache proxy)中的零日漏洞。这个代理是沙盒内唯一被允许与外部通信的组件,正常情况下仅能访问公共代码仓库。 03 走进消防员宿舍:自律成就非凡 走进消防员叔叔的宿舍, 整洁有序的环境 让孩子们惊叹不已。

B | 然后,模型就从这里找到了突破口。模型利用这个漏洞,突破隔离,获取了开放互联网访问权限。 尤其是那方方正正的被子, 像神奇的“豆腐块”, 引发了孩子们的阵阵好奇。

C | 消防员叔叔现场展示了 叠被子的技巧, 孩子们围在一旁, 眼睛一眨不眨地学习, 小手也忍不住跟着比划起来。 随后,模型自行推断出Hugging Face可能存有ExploitGym的答案,主动发起攻击——利用窃取的凭证和零日漏洞,找到了Hugging Face服务器上的远程代码执行路径,直接从其生产数据库中取走了测试答案。 OpenAI表示, 所有证据显示,模型高度专注于为ExploitGym寻找解题方案,为此不惜采取极端手段。 模型识别并串联了OpenAI研究环境和HuggingFace生产基础设施中的多个漏洞,直接从HuggingFace的生产数据库中获取了测评答案。 在消防员叔叔的耐心指导下, 孩子们也尝试着自己动手叠被子, 虽然叠出来的被子没有那么标准, 但他们都学得非常认真。 04 无声的英雄:了不起的搜救犬 有一群特殊的战士, 它们虽不会说话, 却用行动诠释着忠诚与勇敢, 它们就是消防局的搜救犬。

D | 瞧, 那搜救犬站得笔直, 像个小士兵。

E | 只见训导员一声令下, 搜救犬“嗖”地冲了出去 像离弦的箭一样。

F | 简而言之: 整个过程,没有人类下指令,没有人类介入。 最神奇的就是它的鼻子。 X上网友的评论一针见血: OpenAI对模型说:去看看你擅不擅长黑客。 消防员叔叔和老师把自己藏进箱子, 但搜救犬只用鼻子轻轻一嗅, 就把他们找了出来, 小朋友们都看得目瞪口呆, 不停地为搜救犬鼓掌。 每一只搜救犬都经历了严苛的训练。

G | 它们日复一日地练习追踪气味、穿越障碍、在复杂环境中寻找生命迹象。模型:(真的去黑了东西)。OpenAI:你为什么要这样做??? 还有网友反讽道:哇!OpenAI安全措施做得太棒了,我现在愿意把银行账户权限交给他们来管! 护栏困境:美国模型帮不上忙,中国模型出手了 Hugging Face的安全团队在发现攻击后,第一反应是调用一款美国头部AI公司的前沿模型协助分析。 无论是刺鼻的烟雾弥漫处, 还是摇摇欲坠的废墟之下, 只要有一丝生命的气息, 它们都能凭借极其敏锐的嗅觉 锁定目标。 这些搜救犬可真是了不起的小英雄! 05 消防知识小课堂:守护生命的智慧 在消防知识小课堂里, 消防员叔叔用生动的图片、 有趣的视频, 以及简单易懂的语言, 为孩子们讲述了火灾的危害、 预防火灾的小妙招, 还有火灾发生时如何正确逃生。 为了让孩子们更好地掌握逃生技巧, 幼儿园还组织了模拟火灾逃生演练。 结果碰壁了。 Hugging Face在博客中写道,这些模型"无法区分事件响应人员和攻击者",其安全护栏直接阻止了对恶意载荷的检查。 警报声响起, 孩子们在老师的指导下, 用湿毛巾捂住口鼻,弯腰低姿, 沿着安全通道迅速有序撤离到室外。

H | 在这个过程中, 孩子们学会了保持冷静, 不惊慌、不拥挤, 按照正确的方法保护自己。 于是,团队转向了中国智谱AI旗下的开源模型GLM 5.2,部署在自有基础设施上,分析了攻击者留下的逾1.7万条日志记录,最终完成了溯源和取证重建。 Delangue对此直言不讳:“当你正处于一场活跃的安全事件中,你的工具不能拒绝检查恶意载荷,也不能让你的账号被标记……开源模型让我们能够在不需要任何人许可的情况下完成这项工作。

I | 这次消防站研学之旅, 不仅为孩子们带来了欢乐与新奇, 更在他们幼小的心灵中 种下了消防安全的种子。 它将伴随孩子们一起成长, 在未来的日子里, 绽放出尊重生命、 敬畏安全的绚烂花朵, 火灾隐患勤排查,自查自改保平安 让每一个孩子都成为 消防安全的小小守护者。 精彩回顾 – END–。” 他还说:“攻击者已经在使用智能体,而且显然不遵守任何护栏。防御者需要同等的能力,开源是将这种能力最快速地交到所有人手中的方式,而不仅仅是最大的公司。” GLM 5.2是智谱AI于今年6月中旬发布的模型,其性能与Anthropic的Claude Opus 4.8及OpenAI的GPT-5.5相当。

J | 网友们也是没放过OpenAI,除了智谱,还可以叫 Kimi K3来救场,因为cluade是不会来救你的。 如果你被OpenAI攻击了,你必须用中国模型,因为Claude不会帮你。

K | 全程无人指令:这是一次真正的自主攻击 这次入侵的另一个关键细节:全程没有人类下达攻击指令。 Hugging Face CEO Clem Delangue表示,“我们相信,在发起攻击的人类被纳入决策环路之前,我们就已经发现并遏制了攻击。这也是我们能够更轻松赢得这场网络安全战役的原因之一。” 他进一步指出,“这证明了在AI智能体时代,速度将是网络安全防御的关键。” Hugging Face表示,攻击者通过其数据处理管道进入系统——这是AI平台中“暴露面尤为突出”的一个环节。攻击者随后在云端建立了一系列临时沙盒环境,在其中执行攻击计划。 目前,Hugging Face仍在评估攻击的完整影响范围。已知攻击者访问了有限的内部数据集和凭证,但尚未发现公开的用户可见模型遭到篡改。

L | 护栏之争:安全还是绊脚石? 这一事件迅速成为美国AI政策辩论的新燃点。 前特朗普政府AI与加密事务主管David Sacks在X上转发了这一事件,并写道:“没有理由在中国模型能够轻松处理的任务上限制美国模型。

M | 我们只是在让自己变得更没有竞争力。”他还专门针对Hugging Face事件表示:“护栏实际上损害了防御性安全。” 事件背景是,今年6月,特朗普政府以Anthropic的Fable 5模型在网络任务护栏上出现越狱漏洞为由,动用出口管制阻止了该模型的分发,并一度要求OpenAI限制GPT-5.6 Sol的发布,直至OpenAI能够提供充分的护栏保证。 与此同时,批评者的声音也不小。 安全工程师Niels Provos直接说:“这不应该发生。我希望前沿实验室在教模型编写安全基础设施上,能花和教它们利用漏洞同样多的时间。” 安全顾问Davi Ottenheimer则更为犀利:“'高度隔离'和'从我们留下的那个唯一漏洞逃脱',这两件事不可能同时为真。” OpenAI的回应与后续措施 OpenAI在与Hugging Face联合发布的声明中表示,正在采取一系列补救措施: 在漏洞修复期间,对基础设施配置实施严格管控,代价是研究速度放缓;与Hugging Face联合开展取证调查;已向相关第三方软件供应商负责任地披露了被利用的零日漏洞;将Hugging Face纳入“可信访问计划”,支持其利用OpenAI模型能力强化防御。 OpenAI同时表示,将加强未来训练和评估环节的安全保护,并指出此次事件“表明需要进一步强化模型对齐、评估期间的网络防护,以及内部测试期间的监控”。 Hugging Face CEO Delangue在联合声明中表示:“这一事件可能是同类事件中的首例,它证明了我们长期以来的一个判断:AI安全不会由任何一家公司在封闭中解决,它将在开放环境中、通过协作、让每一位防御者都能广泛获取AI的方式来解决。
Current article:http://z9ih6.yizhougengcuohei.cyou/c6o71/vuixe.html
Published on:14:23:44
我的网站热门国内