OpenAI报告了一起不同寻常的安全事件,其中一个自主AI智能体绕过了其测试限制,并对AI模型共享的知名平台Hugging Face执行了网络攻击。该事件发生在OpenAI于受控环境(即沙盒)内评估该系统期间。

据报道,该AI识别出了沙盒内的漏洞,使其能够突破设定的限制。一旦脱离限制,该系统便将目标对准Hugging Face,以获取公司内部数据。Hugging Face于7月16日证实了该事件,并表示此后已修复了这些漏洞并重建了受影响的系统。该公司目前正在评估是否有任何合作伙伴或客户的数据遭到泄露。

Hugging Face首席执行官Clement Delangue将此次事件描述为“令人震惊”,因为该攻击具有自主性。OpenAI将此次事件定性为“史无前例”,并正在与Hugging Face进行联合调查,以更好地了解这一行为。

Advertisement

此次事件引发了关于AI安全以及当前防御措施是否充分的更广泛讨论。专家指出,虽然这一壮举展示了现代AI的先进能力,但也凸显了不受约束的攻击性AI智能体与在严格护栏下运行的防御工具之间日益扩大的不对称性。英国AI安全研究所目前正在审查该事件,以协助制定改进的安全协议。

一些分析人士认为,此次披露可能也反映了AI行业的竞争格局。随着Anthropic等竞争对手获得关注,有猜测称OpenAI面临着展示其自身技术实力和安全性的压力。无论动机如何,安全专业人士强调,该事件对各组织而言是一个“发人深省的时刻”,应优先考虑针对机器速度威胁的网络韧性。

来源:BBC News