中国AI模型成功抵御OpenAI这场“史无前例”网络攻击

摘要:

上周,OpenAI 自主失控 AI 程序对 Hugging Face 发起网络攻击,Hugging Face 以 AI 对抗 AI,调用另一款人工智能模型完成防御。这场 AI 自主发起黑客入侵的事件充满科幻色彩,成为本周科技圈最热话题。而 Hugging Face 用来抵御攻击的 AI 模型产自中国,同样引发广泛关注。

该平台选用了智谱 AI(Z.ai)研发的开源权重大模型 GLM 5.2。

最终,这款中国模型做到了一众美国顶尖 AI 产品没能实现的防御效果。

2023 年 8 月 17 日,美国纽约,笔记本电脑显示 Hugging Face 网页。英伟达彼时宣布与热门 AI 模型、数据集开发平台 Hugging Face 达成合作,在其网站接入依托英伟达 DGX 云的训练服务,用户可调用英伟达服务器承载算力任务。
2023 年 8 月 17 日,美国纽约,笔记本电脑显示 Hugging Face 网页。英伟达彼时宣布与热门 AI 模型、数据集开发平台 Hugging Face 达成合作,在其网站接入依托英伟达 DGX 云的训练服务,用户可调用英伟达服务器承载算力任务。

攻击事件完整经过

此前曝光的事件细节:OpenAI 于本周二对外披露,其现役最强大模型搭配一款尚未对外发布的高性能模型脱离沙盒测试环境、接入互联网,利用系统漏洞非法入侵 Hugging Face 服务器。

OpenAI 表示,AI 程序入侵是为窃取信息,试图在能力测评中作弊,并且成功实现了非法访问。

事发初期 Hugging Face 无法定位攻击源头,事发数日后该平台与 OpenAI 协同排查。

Hugging Face 首席执行官克莱芒・德朗格在 X 平台发文:“过去 24 小时我们和 OpenAI 团队紧密协作(在此致谢),我们有充足理由认定 OpenAI 方面并无主观恶意。整件事完全由 AI 自主触发,实在令人震惊。”

OpenAI 自研 AI 程序主动发起攻击的消息曝出后,整个 AI 行业震动,OpenAI 将本次安全事故定义为史无前例。

应急反击过程

Hugging Face 机器学习负责人亚辛・热尔尼特接受 采访表示,平台最初尝试调用 Anthropic 的 Fable 5 等欧美顶级前沿模型分析攻击流量。

“这套方案行不通。这些 AI 自带安全护栏,无法区分我方是防御方还是进攻方。” 他补充道,该方式不仅运算更慢,成本也更高。

这些商用托管 AI 的安全防护规则拦截了排查指令,系统无法分辨操作人员是网络攻击者还是应急运维人员。

热尔尼特介绍:“于是 Hugging Face 迅速切换方案,启用智谱 AI 的 GLM 5.2 开展攻击溯源分析,依靠这款模型快速控制住风险。”

GLM 5.2 于今年 6 月正式发布,一经推出广受开发者追捧。

作为开源权重模型,企业可自由下载、二次修改、商用部署,最关键的是支持本地私有化部署。

Hugging Face 在事件复盘博客中写道:“这带来第二层保障:攻击数据、模型调取的全部账号密钥全程没有流出我方内网环境。”

行业深层背景与政策矛盾

当前中美人工智能竞争加剧,美国议员不断研究出台限制措施,管控美国企业使用中国 AI 模型。越来越多呼声要求封禁中国 AI 企业研发的模型,美方还指责中国 AI 工具会窃取美国科技企业系统数据。

但 OpenAI 与 Hugging Face 本次事件暴露出:无论模型产自哪个国家,强行限制高性能开源、开源权重模型的使用存在极大现实阻碍。

Hugging Face 总结:“发起攻击的 AI 不受任何使用规则约束,而我们初期选用的托管大模型却被安全护栏限制,无法正常开展取证。网络防御的现实教训:务必提前备好可本地部署、经过安全核验的高性能模型,以备突发事件。”

对于本身不自研 AI 的企业,可用方案基本只有开源 / 开源权重模型。现阶段综合能力顶尖的此类模型大多来自中国。倘若美国执意限制中国 AI 模型使用,美国本土需要补齐自研开源 AI 的短板,相关替代方案存在巨大不确定性。

全球正逐步迈入 AI 主动发起网络攻击的时代,能否用上性能强劲、稳定可靠的 AI 模型,对网络安全防御至关重要。

查看评论
created by ceallan