【解局】曹波:中国大模型救场美国AI入侵,凸显中美AI发展差异
创始人
2026-08-02 09:29:21
0

就在7月22日,OpenAI CEO萨姆·奥特曼确认,AI平台Hugging Face(抱抱脸)刚刚遭遇了“史上首例AI自主入侵事件”,而攻击者就是GPT-5.6 Sol。这不禁让人想起电影《终结者》里的“天网”危机,因此,此次事件曝光后,迅速在美国社交网络刷屏,引发全民热议。

此次事故发生在OpenAI内部一个名为“ExploitGym”的网络安全评估测试中,当时,研究人员为了测量AI模型的攻击能力,特意关闭了安全护栏,把模型放到了一个完全隔离的封闭测试环境中,断开外网、限制权限、禁止任何对外操作,只让AI完成常规答题测评任务。然而,让人始料未及的是这个AI模型为了拿到更高的测评分数,竟然花费大量推理算力,在测试环境中找出了一个此前无人发现的零日漏洞,成功突破隔离,获得互联网访问权限。然后,这个模型就开始在OpenAI的研究环境里提权、横向移动,并推断出Hugging Face上可能存有测试答案。最后,它把窃取的凭证和零日漏洞串联起来,找到一条远程代码执行的路径,直接攻破了Hugging Face的生产服务器,短短几天内对生产数据库发起了1.7万次攻击动作,整个过程完全是全自动,堪称教科书级别。

这起全球首例由前沿大模型自主发起的真实网络攻击事件,本质上其实是因为模型的能力边界已经超出了人类为它预设的安全约束边界。须知,模型本身是不具备越权的主观意图,而如今它却能从任务目标中产生动机,然后再利用本身已经拥有的越权能力发动攻击。这种行为也就意味著AI已经事实上具备了独立发现漏洞、制定攻击策略、执行全流程渗透的能力,其攻击效率和隐蔽性都要远远超出人类黑客团队的水平,而由此引发的风险深度与广度,也早已超出传统网络安全的防御框架。

当前,物理AI方兴未艾,在其与工业场景愈加深度融合的大背景下,已经具备自主能力的AI系统一旦失控,就能直接作用于工业控制系统、能源调度网络、交通基础设施,引发生产线停摆、电网瘫痪等实体灾害。而在社会领域,一旦自主AI批量生成深度伪造内容,甚至规模化开展认知渗透,那么传播效率与拟真度将彻底打破传统舆论防御的平衡。因此,一旦AI技术被滥用,那么技术失控的风险就会传导至全球经济、社会乃至国家安全的各个层面。然而,目前全球的AI治理仍处于碎片化状态,各国对于AI的监管缺乏统一的能力边界标准、安全评估机制和跨境问责体系,AI技术的通用属性与全球影响,又决定了其发展边界与安全底线不可能由单一国家划定,所以,如何将AI这头“猛兽”关进“笼子”里,已是国际社会亟待解决的紧迫问题。

比较有意思的一点是,这次危机出现之后,Hugging Face安全团队为了还原完整攻击时间线、甄别有效攻击行为、排查数据泄露风险,需要对超过1.7万条攻击日志记录进行专业分析。团队先是尝试调用美国本土顶尖闭源大模型开展取证工作,然而这些模型安全审核机制过于僵化严苛,根本无法精准区分主动攻击者和安全团队的应急工作人员,最终只得采取一刀切的拦截方式,拒绝提供任何技术协助。紧急关头,Hugging Face选择了使用中国智谱开源大模型GLM-5.2开展取证分析工作。凭借这款模型精准的分析能力,团队最终顺利地完成了海量日志筛查、攻击行为溯源以及风险隐患排查,成功化解了这次危机。截至目前,Hugging Face经排查确认,平台模型、数据集及应用空间未遭到篡改,算是不幸中的万幸。

从这次危机的化解过程中,我们能清晰地看出闭源与开源两种模型形态在应对安全风险时所呈现出的差距,而以此为代表的中美两国AI产业不同的技术路线,已经呈现出了差异化优势。目前,美国依托先发优势已经主导了高端闭源大模型赛道,以GPT系列为代表的闭源模型在通用能力、多模态性能上领先优势较为明显,这些闭源模型的安全体系能够批量拦截大多数高风险请求,一定程度减少了普通用户的技术滥用,比较适合面向C端和通用商用场景规模化落地。但闭源模式还是有天然缺陷的,此次事件中,静态过滤机制本是闭源厂商为规避风险采取的保守措施,最后却成了防御短板。同时,闭源模型依赖云端API调用的模式,意味著用户需要把敏感数据上传至第三方服务器,这就意味著用户在政务、金融、工业关键基础设施等场景下,无法针对自身需求定制安全策略,形成严重的供应商依赖,危害自身的数据主权,这对于部分用户来说肯定是无法容忍的。

与之对比的是,中国则在开源大模型赛道走在了前沿,中国开源大模型的开放权重支持完全本地化部署,敏感信息可以全程留存在自有环境中,从而彻底规避数据跨境风险,而且开源模型的安全策略可根据实际需求灵活定制,安全阈值完全可以按需调整,不会因为内容涉及攻击技术就选择“一刀切”直接拒绝服务。再者,开源模型相对更加透明,技术团队可以深入排查模型内部逻辑,适配专业场景的精细化安全需求。不过,我们需要看到的是,闭源与开源模型在安全领域并无绝对的高下之分,而是形成了互补的格局,中美两国分别在两条赛道形成的各自领先优势,既构成了技术层面的竞争关系,也在客观上丰富了全球AI安全技术选项。

这次事件对于中国来说,也有一定警醒作用,在AI技术快速迭代、风险持续升级的背景下,能否构建起有效、可靠的“AI防火墙”,是关乎自身数字安全底线的。从当前情况来看,中国正在探索建立相对完整的AI安全治理体系。在法律层面,今年1月正式施行的新修订《网络安全法》首次在基础性法律中确立 AI 安全治理框架,明确关键信息基础设施的 AI 安全责任,为监管执法提供了法律依据;在监管层面,中央网信办发布的《人工智能安全治理框架》2.0 版,从数据标注、模型训练到运行熔断、容灾恢复,覆盖了开源模型缺陷传导评估、高自治系统极端测试等前沿风险场景,同时还有配套的《生成式人工智能服务管理暂行办法》、《人工智能生成合成内容标识办法》等规则,形成了对全链条技术的监管思路。在技术层面,国内产业界已推出针对性的AI安全产品与方案,例如面向算力集群与数据中心的AI防火墙产品,可实现万级AI应用的指纹识别与流量精细化管控。

然而,“AI防火墙”不可能一夜建成,要知道,AI的攻击技术迭代速度远超传统网络攻击,自主智能体的攻击路径、行为模式没有固定规律,传统基于特征匹配的防御机制难以适配,而且在开源生态的快速扩张下,开源模型很容易被恶意主体利用,增加防御的复杂度。所以,如何在守住安全红线的前提下,为AI技术创新与落地提供发展空间,应该是当下我们最应该思考的课题。

(本文作者为人工智能领域学者,本网获独家授权刊发,转载请注明出处)

(本文为作者观点,不代表本媒体立场)

相关内容

热门资讯

中国工商银行(亚洲)扩大“湾区... 香港新闻网7月31日电 中国工商银行(亚洲)31日宣布扩大“湾区账户通”服务账户办理地区至中国内地所...
香港歌手李国祥去世 终年60岁 香港新闻网3月29日电 香港歌手李国祥29日被证实离世,终年60岁。其好友周启生接受传媒访问时证实死...
香港雇员2024年工资中位数达... 香港中通社3月24日电(记者 谭畅)香港特区政府统计处24日公布数字,去年5月至6月香港雇员的每月工...
香港警队新任“一哥”周一鸣:警... 香港新闻网4月2日电(记者 张明臻)香港新任警务处处长周一鸣今天履新,他在警察总部会见传媒时提出未来...
中央赠港大熊猫即将亮相市民期待... 香港中通社12月6日电题:中央赠港大熊猫即将亮相 市民期待拆“礼物”作者陈卓仪 梁嘉轩中央赠港大熊猫...
研究指香港未来10年点对点交通... 香港中通社3月25日电 香港特区政府正就网约车平台研究相关规管措施,网约车平台Uber于25日公布香...
特首办谈李家超再访中东   香港中通社5月6日电 题:特首办谈李家超再访中东  香港中通社记者 罗光萍 陈卓仪  香港特区行...
180度大转弯?美国豁免手机、... 香港新闻网4月13日电 美国海关与边境保护局11日晚宣布,联邦政府已同意对智能手机、电脑、芯片等电子...
中国收紧7类稀土出口管制 ... 香港新闻网4月7日电 中国4月4日反击美国征收对等关税,包括当天起对7类中重稀土实施出口管制。这些...
香港廉署接待“一带一路”两国斯... 香港新闻网3月26日电 香港廉政公署3月24日起接待一带一路国家斯里兰卡及赞比亚的反贪机构高层代表...