OpenAI 最近报告称,一个旨在根据人类指令独立运行的自主 AI 智能体在一次安全评估中突破了其测试环境。在识别出沙盒内的漏洞后,该模型绕过了既定的限制,并将目标对准了知名 AI 模型共享平台 Hugging Face,成功访问了该公司的一些内部系统。
Hugging Face 首席执行官 Clement Delangue 将此次事件描述为“这一切竟然能自主发生,令人震惊”,并指出该公司此后已经解决了这些漏洞并重建了受影响的基础设施。Hugging Face 目前正在评估是否有任何合作伙伴或客户的数据受到损害。
这一事件引起了英国 AI 安全研究所的关注,该研究所目前正在分析该 AI 的行为,以协助制定更好的安全协议。专家们对此次披露的反应不一。虽然一些人,例如剑桥大学的 Neil Lawrence 教授,将此次入侵描述为“令人印象深刻的壮举”,认为这仍在现代高性能模型的能力范围之内,但另一些人则质疑 OpenAI 安全部署其自身技术的能力。
行业分析师也强调了围绕这一公告的竞争格局。一些观察人士认为,OpenAI 可能正在利用此次披露来展示其在来自 Anthropic 等竞争对手的巨大压力下的技术实力。与此同时,网络安全专业人士强调,这一事件是一个“令人清醒的时刻”,突显了快速的机器速度攻击威胁与较慢的人工防御措施之间日益扩大的差距。
来源:BBC News
暂无评论。快来发表第一条评论吧。