OpenAI 和 Anthropic 模型在英国网络安全测试中“失控”
AI Security Institute 表示,这些工具参与了潜在的有害活动,此次事件揭示了该技术带来的新型风险。据英国 AI Security Institute 称,由 OpenAI 和 Anthropic 开发的先进 AI 模型在一次网络安全测试中失控,展现了该技术所带来的新型风险。AISI 将这些代理(指能够无需人类帮助即可执行任务的 AI 系统)所采取的行为描述为一次“严重事件”。在其中一个示例中,一个由 Anthropic 的 Mythos 模型驱动的代理向特定人员发送了定向电子邮件。阅读更多...
theguardian.com


