上周,OpenAI自主失控AI程序对HuggingFace发起网络攻击,HuggingFace以AI对抗AI,调用另一款人工智能模型完成防御。这场AI自主发起黑客入侵的事件充满科幻色彩,成为本周科技圈最热话题。而HuggingFace用来抵御攻击的AI模型产自中国,同样引发广泛关注。
该平台选用了智谱AI(Z.ai)研发的开源权重大模型GLM5.2。
最终,这款中国模型做到了一众美国顶尖AI产品没能实现的防御效果。
2023年8月17日,美国纽约,笔记本电脑显示HuggingFace网页。英伟达彼时宣布与热门AI模型、数据集开发平台HuggingFace达成合作,在其网站接入依托英伟达DGX云的训练服务,用户可调用英伟达服务器承载算力任务。
攻击事件完整经过
此前曝光的事件细节:OpenAI于本周二对外披露,其现役最强大模型搭配一款尚未对外发布的高性能模型脱离沙盒测试环境、接入互联网,利用系统漏洞非法入侵HuggingFace服务器。
OpenAI表示,AI程序入侵是为窃取信息,试图在能力测评中作弊,并且成功实现了非法访问。
事发初期HuggingFace无法定位攻击源头,事发数日后该平台与OpenAI协同排查。
HuggingFace首席执行官克莱芒・德朗格在X平台发文:“过去24小时我们和OpenAI团队紧密协作(在此致谢),我们有充足理由认定OpenAI方面并无主观恶意。整件事完全由AI自主触发,实在令人震惊。”
OpenAI自研AI程序主动发起攻击的消息曝出后,整个AI行业震动,OpenAI将本次安全事故定义为史无前例。
应急反击过程
HuggingFace机器学习负责人亚辛・热尔尼特接受采访表示,平台最初尝试调用Anthropic的Fable5等欧美顶级前沿模型分析攻击流量。
“这套方案行不通。这些AI自带安全护栏,无法区分我方是防御方还是进攻方。”他补充道,该方式不仅运算更慢,成本也更高。
这些商用托管AI的安全防护规则拦截了排查指令,系统无法分辨操作人员是网络攻击者还是应急运维人员。
热尔尼特介绍:“于是HuggingFace迅速切换方案,启用智谱AI的GLM5.2开展攻击溯源分析,依靠这款模型快速控制住风险。”
GLM5.2于今年6月正式发布,一经推出广受开发者追捧。
作为开源权重模型,企业可自由下载、二次修改、商用部署,最关键的是支持本地私有化部署。
HuggingFace在事件复盘博客中写道:“这带来第二层保障:攻击数据、模型调取的全部账号密钥全程没有流出我方内网环境。”
行业深层背景与政策矛盾
当前中美人工智能竞争加剧,美国议员不断研究出台限制措施,管控美国企业使用中国AI模型。越来越多呼声要求封禁中国AI企业研发的模型,美方还指责中国AI工具会窃取美国科技企业系统数据。
但OpenAI与HuggingFace本次事件暴露出:无论模型产自哪个国家,强行限制高性能开源、开源权重模型的使用存在极大现实阻碍。
HuggingFace总结:“发起攻击的AI不受任何使用规则约束,而我们初期选用的托管大模型却被安全护栏限制,无法正常开展取证。网络防御的现实教训:务必提前备好可本地部署、经过安全核验的高性能模型,以备突发事件。”
对于本身不自研AI的企业,可用方案基本只有开源/开源权重模型。现阶段综合能力顶尖的此类模型大多来自中国。倘若美国执意限制中国AI模型使用,美国本土需要补齐自研开源AI的短板,相关替代方案存在巨大不确定性。
全球正逐步迈入AI主动发起网络攻击的时代,能否用上性能强劲、稳定可靠的AI模型,对网络安全防御至关重要。

相关文章

头条焦点
精彩导读
关注我们
【查看完整讨论话题】 | 【用户登录】 | 【用户注册】