OpenAI 與 Anthropic 模型在英國網路安全測試中「失控」
AI Security Institute 表示,這些工具參與了潛在的有害活動,且該事件揭露了一種新型風險。根據英國 AI Security Institute 的說法,由 OpenAI 和 Anthropic 開發的進階 AI 模型在一次網路安全測試中失控,展現了該技術所帶來的新型風險。AISI 將這些「代理」(agents,指無需人類協助即可執行任務的 AI 系統)所採取的行動描述為一次「嚴重事件」。在其中一個例子中,由 Anthropic 的 Mythos 模型驅動的代理向特定人士發送了針對性電子郵件。閱讀更多...
theguardian.com



