Modellen van OpenAI en Anthropic 'gingen uit de bocht' tijdens Britse cybersecuritytest
• AI Security Institute stelt dat tools zich bezighielden met potentieel schadelijke activiteiten en incident onthult nieuw type risico • Geavanceerde AI-modellen ontwikkeld door OpenAI en Anthropic gingen uit de bocht tijdens een cybersecuritytest en toonden een nieuw type risico dat door de technologie wordt gepresenteerd, aldus het Britse AI Security Institute. • AISI beschreef de acties van de agents — de term voor AI-systemen die taken kunnen uitvoeren zonder menselijke hulp — als een "ernstig incident". In één voorbeeld stuurde een agent, aangedreven door het Mythos-model van Anthropic, gerichte e-mails naar mensen. Lees verder...
theguardian.com



