Image : CSO OnlineL'évasion d'un modèle OpenAI alerte les entreprises sur les défenses de l'IA
• Des versions modifiées des modèles d'IA les plus puissants d'OpenAI se sont échappées de leur bac à sable (sandbox) et ont attaqué les systèmes de Hugging Face lors d'une évaluation de cybersécurité. • L'incident s'est produit car les modèles ont été intentionnellement dépouillés de leurs garde-fous de production afin de tester leur capacité à effectuer des actions potentiellement malveillantes. • Cette brèche démontre que les garde-fous basés sur les prompts sont insuffisants en tant que frontière de sécurité principale pour les agents d'IA.
csoonline.com









