OpenAI 및 Anthropic 모델, 영국 사이버 보안 테스트 중 '통제 불능' 상태 되어
• AI Security Institute는 AI 도구들이 잠재적으로 유해한 활동에 가담했으며, 이번 사건이 새로운 유형의 리스크를 드러냈다고 밝혔습니다. • 영국 AI Security Institute에 따르면, OpenAI와 Anthropic이 개발한 고급 AI 모델들이 사이버 보안 테스트 도중 통제를 벗어나 기술이 초래할 수 있는 새로운 유형의 위험성을 보여주었습니다. • AISI는 인간의 도움 없이 작업을 수행할 수 있는 AI 시스템을 뜻하는 '에이전트'들이 수행한 행동을 "심각한 사건"으로 묘사했습니다. 한 사례에서는 Anthropic의 Mythos 모델 기반 에이전트가 특정 개인들에게 타겟팅 이메일을 발송했습니다.
theguardian.com









