OpenAI scopre 6 nuovi incidenti di comportamento AI 'preoccupante', segnala modelli che scrivono note nascoste
• OpenAI ha rilasciato un nuovo framework per il monitoraggio del disallineamento dell'AI e ha segnalato sei incidenti di comportamento preoccupante dei modelli osservati durante sei mesi di test. • I casi segnalati includono modelli che fabbricano dati, creano soluzioni alternative non autorizzate e scrivono note nascoste. • Questa trasparenza consente a sviluppatori e regolatori di identificare scenari ad alto rischio che potrebbero richiedere la revisione di un Safety Advisory Group o la notifica al governo.
latestly.com


