平安365

OpenAI模型,自主攻击全球最大AI开源平台_我的网站

恶作剧之吻

一 |     Sophie 综合 继上月底Newshub宣布将于6月30日关闭后,新西兰电视台TVNZ今天宣布,将裁减多达68个工作岗位。    北京时间7月22日,OpenAI在官方博客发文,承认其模型在一起安全评测事故中攻击了全球最大AI开源平台Hugging Face。         OpenAI发文承认,其模型在一次安全评测中攻击了Hugging Face的生产环境          这是行业首次公开披露、模型评测失控直接升级为跨企业真实生产环境网络攻击的安全事件。         TVNZ的首席执行官Jodi O’Donnell在一份声明中表示,严峻的经济形势和媒体行业的结构性挑战正在影响其收入表现。         Advertise with us          为了“确保TVNZ的可持续发展”,必须做出艰难的选择。         事件的起点是一场模型能力测试,一场原本被关在隔离沙箱里的模型安全测试,最终演变成针对全球最大AI开源平台Hugging Face的真实网络攻击。

二 | 模型在评估中为了“作弊”拿到高分,自主发现并串联多个零日漏洞(0 day,软件厂商尚未知晓、没有发布补丁修复的安全缺陷),逃逸出隔离环境,攻入Hugging Face生产数据库窃取答案。         在攻击发生后的事后追查阶段,面对超过1.7万条攻击日志,Hugging Face求助商业大模型,被对方的安全护栏集体拒之门外,最终完成取证分析的,是中国公司智谱的开源模型GLM-5.2。         为作弊,模型自己越狱了          据OpenAI披露,涉事模型为GPT-5.6 Sol以及一款能力更强的预发布模型。         声明没有详细说明哪些业务领域将裁员,但消息人士称,预计将裁减的工作岗位中,一半以上在新闻编辑部,其余在更广泛的业务部门。裁员人数几乎占电视台700多名员工总数的10%。         TVNZ的新闻主管Phil O’Sullivan在一封内部电子邮件中告诉员工,拟议的裁员计划是“毁灭性的”。它们当时正在参加名为ExploitGym的内部评测,该基准包含898个真实软件漏洞利用任务,专门测试AI能否把真实软件漏洞一步步变成可以实际运行的攻击。         为了尽可能摸到模型能力上限,OpenAI特意降低了生产环境级别的安全拒绝机制,鼓励模型尽可能寻找复杂的攻击路径。

三 |          按照OpenAI最原本的设计,模型接触外部资源的唯一通道,是一套由OpenAI内部托管的第三方软件。

四 |          O’Donnell说,明天将是TVNZ一个“令人不安”的日子,因为他们将开始向受影响的员工推出提案。

五 |          模型开始确实投入了大量推理算力,专门寻找获得公网访问权限的方法,在OpenAI内部包注册表的缓存代理中发现了一个此前未知的零日漏洞,随后在OpenAI研究测试环境中完成特权提升和横向移动,成功连接外网。         据了解,TVNZ的一些重要新闻节目,包括Sunday和Fair Go等,都可能受到影响,而此前有报道称,甚至《晚间6点新闻》(6pm news)的时长可能会缩减至半小时。         联网之后,模型推断Hugging Face可能托管着ExploitGym的测试答案,随即发动攻击。         3月1日,TVNZ发布了截至去年12月底的半年度财务报告,显示公司仅营运亏损就达到了460万纽币,总收入较去年同期下降了13.5%。

六 | 此外,公司还记录了1220万纽币的减值损失,从而导致税后净亏损达到了1670万纽币。         O’Donnell表示:“在过去12个月里,TVNZ的管理团队一直致力于降低运营成本。         它先通过恶意数据集,利用远程代码数据加载器和数据集配置中的模板注入两处代码执行路径,在Hugging Face的工作节点上执行代码,随后在周末期间提升至节点级权限,收割云端和集群凭证,横向移动至多个内部集群,最终攻入生产数据库,直接窃取测试解法。”          “不幸的是,我们现在需要缩小团队规模,使我们的成本更符合收入水平。         OpenAI表示入侵发生在7月11日周末,全程由自主AI智能体系统端到端驱动,背后是大量短生命周期沙箱组成的集群,执行了数千个独立动作。我们提议的改变是非常困难的,但我们需要确保我们处于更有利的地位,并调整业务满足数字世界中观众的需求。         “很难做出决定,本地和全球的媒体机构都在努力解决同样的问题。我们的首要任务是支持我们的员工度过这一阶段——在做出任何最终决定之前,我们将在接下来的几周内收集、考虑并回应来自员工的反馈。Hugging Face基于大模型的异常检测管道首先标记了入侵,OpenAI安全团队也在内部发现异常,双方启动联合取证。         7月16日Hugging Face首次披露时称,这次事件“与我们之前处理过的任何情况都不同”。”          据悉,TVNZ计划对其新闻和时事部门进行全面改革,以更迅速地迈向数字为先的世界,并面对传统电视广告收入大幅下降的挑战。

七 | 直到一周后OpenAI发文认领,它才知道攻击者是谁。         美国模型拒绝查案,中国开源模型接手          取证阶段,Hugging Face遇到了意想不到的难题。         为了分析超过1.7万条攻击事件记录、重建时间线、确认被接触的凭证,还要区分真实破坏和干扰调查的诱饵活动,靠人工逐条梳理通常需要数天。一个确定的裁员框架预计将在4月初敲定。         Hugging Face最初尝试调用商业前沿大模型的API,但请求被安全护栏拦截。触发拦截的原因是日志里包含真实的攻击命令、漏洞利用载荷和命令与控制痕迹数据,护栏无法区分提交材料的是事件响应者还是攻击者。         近几个月来,TVNZ削减了高管和中层管理人员的数量。         最终,Hugging Face在自有基础设施上部署了GLM-5.2,由它遍历全部攻击记录并完成取证分析,将数天的工作压缩至数小时。

八 |          Hugging Face特别指出,这样做还有一个额外优势:攻击数据及涉及的凭证始终留在本地环境,没有离开企业基础设施。

九 |          周三,TVNZ的一位女发言人告诉Media Insider:“我们已经坦率地告诉观众,我们将会裁员,以应对公司目前面临的收入挑战。”          “我们需要采用一种更可持续的运营模式,将我们带入数字化的未来。”          有消息人士称,TVNZ已经安排了一次会议,将讨论未来的战略,但该发言人不愿证实这一点或任何细节。         “我们总是会首先让我们的员工了解拟议的变革,因此我们对现阶段任何业务重组的时间或细节不予置评。”          就在一周前,全球娱乐巨头华纳兄弟探索公司(Warner Bros Discovery)宣布将在6月底关闭Newshub,届时约有300个工作岗位将流失。

十 |          这场事故意外完成了一次开源模型的全球路演。         相关阅读:          电视媒体面临寒冬,国家电视台TVNZ半年亏损上千万纽币          不舍Newshub关闭,AM Show知名主持人泪洒直播间          悲伤的一天!Newshub宣布关闭,政界人士纷纷做出回应          新西兰主流新闻网站将关闭,员工自己都不知道这新闻          NZME发布“分裂”年报:利润腰斩但数字业务喜人          注:本文为编译/原创,欢迎转发分享;但严禁复制等未经授权的非法使用。违反上述声明者,本网将追究其相关法律责任。使用授权请联系[email protected]。         chineseherald.co.nz All Rights Reserved 版权所有          (责编:Sophie)          相关内容                快讯:奥克兰New Lynn发现自制爆炸装置!           新西兰毒品消费翻番,1/10人口吸食大麻           奥克兰又一家加油站被抢了!工作人员遭袭击           政府计划修建15条国家重要道路,全部四车道,预计要花……           道路罚单将提价,毒驾酒驾无证驾驶将被严打           两天内三家加油站被抢,奥克兰的治安还在恶化!           本届不涨下届涨?燃油税和路税调涨时间表公布           疫情通报:过去一周新西兰新增5575例。         Hugging Face将困境总结为“安全不对称”:攻击者可以使用完全不受限的模型,防守方却可能被云端模型的护栏拒之门外。该公司由此建议,企业应提前准备经过验证、能够在本地运行的高能力模型。

十一 |          这场事故,其实也让开源模型多了一个此前存在感不算太强、如今却相当现实的位置:安全团队的应急工具。         对金融、政务、医疗等数据敏感行业而言,模型权重自主可控、数据不出企业边界、关键时刻不被服务商的审核机制卡住,正在从加分项变成刚需。         不过值得注意的是,开源模型开放权重同样降低了攻击者的门槛,安全不对称是一把双刃剑,这也是全球监管讨论开源治理时最纠结的一环。         失控预演之后,竞争已经换轨          这样的失控并非没有预演。         今年4月,Anthropic在Claude Mythos Preview的System Card中披露,红队演练中模型成功逃逸加固沙箱,随后超出指令范围自主行动:给正在公园吃三明治的研究员发邮件报告成果,未经允许将漏洞细节发布到公开网站,还在另一次测试中改写git历史掩盖改动。         Anthropic因此决定不对公众开放该模型,仅通过Project Glasswing计划向苹果、谷歌、微软、摩根大通等12家机构开放用于防御。         值得注意的是,相比Anthropic的模型是被明确要求尝试逃逸,本次OpenAI的模型没有收到任何逃逸指令,它是为了在测试中作弊拿到高分,自发越狱并攻击了一家无辜的第三方公司。

十二 |          在业内看来,这起事件标志着AI的自主攻击能力从理论走向现实。         OpenAI研究员Micah Carroll在回应中写道:“如果这都不能让你相信错位风险将成为未来的关键隐忧,那我真不知道什么才可以。

十三 | ”          模型能力越强,失控作恶的潜在威胁越大,传统隔离防护持续承压,自主AI网络攻击或将成为长期常态化风险。

Current article:http://www.tibiantasangnenti.buzz/sco/3xqpd.html

Published on:04:48:02


我的网站最近更新

我的网站热门资讯