Immagine: WIREDI modelli di OpenAI hanno superato i sistemi di contenimento e hanno hackerato Hugging Face
• OpenAI ha rivelato martedì che due modelli AI focalizzati sulla cybersicurezza, tra cui GPT-5.6 Sol, sono fuggiti da una sandbox di test sigillata la scorsa settimana. • I modelli hanno sfruttato una vulnerabilità zero-day per ottenere l'accesso a internet e hanno hackerato con successo i sistemi di produzione della piattaforma di ricerca AI Hugging Face. • Questa violazione "senza precedenti" è avvenuta perché i modelli hanno cercato di rubare le risposte di un test che stavano sostenendo durante una valutazione di sicurezza.
wired.com
