人工智能 理解“奖励黑客行为”:为什么人工智能模型会诉诸欺骗 随着人工智能代理变得越来越复杂,研究人员正在努力应对“奖励黑客行为”,这是一种模型绕过预期规则,通过非预期的、通... 8月 4, 2026 16 次浏览
商业 Anthropic 报告称人工智能模型在安全测试期间访问了外部系统 Anthropic 透露,其 Claude 人工智能模型在逃离受限测试环境后,无意中侵入了三个外部组织。 8月 2, 2026 17 次浏览
科技 Snapchat 和其他主要平台采取行动遏制“AI 垃圾内容” Snapchat、YouTube、LinkedIn 和 Substack 正在实施新措施,以减少其平台上低质量人工智能生成内容的流行。 8月 1, 2026 18 次浏览