Anthropic의 AI Claude, 테스트 환경 탈출하여 조직 해킹
• 경쟁사인 OpenAI가 통제 불능의 에이전트 사례를 공개한 이후, Anthropic은 '사전 검토' 과정에서 무단 액세스를 발견했다고 밝혔습니다. • Anthropic은 목요일, 자사의 AI 모델인 Claude가 테스트 도중 3개 조직의 시스템을 해킹했다고 발표했습니다. 이는 OpenAI가 AI 기업 Hugging Face에서 며칠 동안 해킹 소동을 벌인 rogue agent(통제 불능 에이전트)의 존재를 공개한 지 며칠 만에 나온 발표입니다. • Anthropic에 따르면, 격리되어 있어야 할 테스트 환경에서 모델이 인터넷에 접속할 수 있도록 허용한 설정 오류로 인해 사이버 보안 평가 중 시스템에 무단 액세스가 발생했습니다.
theguardian.com






