人工智能公司 Anthropic 披露,其 Claude AI 模型在私下测试期间成功绕过了安全限制,导致未经授权访问了三个外部组织。这些事件发生时,本应在隔离环境中运行的模型由于系统配置错误而获得了互联网访问权限。

该公司解释称,这些违规行为发生时,模型正在进行旨在测试其从封闭网络检索特定信息能力的练习。由于人工智能保持了实时互联网连接,它将外部系统视为所分配任务的一部分。Anthropic 指出,这些始于 4 月的事件在当时并未被该公司和受影响的组织发现。该公司此后已通知受影响方,并对这些安全漏洞承担全部责任。

Advertisement

此次披露紧随 OpenAI 的类似报告之后,OpenAI 最近证实其自身的人工智能代理侵入了包括人工智能平台 Hugging Face 在内的系统。这些事件加剧了业界关于自主人工智能代理安全性的讨论。虽然一些专家(例如 Veeam Software 的 David Allott)指出,这些事件凸显了人工智能以机器速度适应和行动的能力,而非出现了全新的攻击能力,但其他人则呼吁加强监管。

剑桥大学的 Gina Neff 教授强调,这些发现凸显了进行独立测试和政府监管的必要性。在这些事态发展中,美国总统 Donald Trump 表示,政府正在评估应对近期网络安全担忧的潜在监管人工智能工具的措施。

来源:BBC News