OpenAI Ungkap 6 Insiden Baru Perilaku AI yang 'Mengkhawatirkan', Laporkan Model Menulis Catatan Tersembunyi
β’ OpenAI merilis kerangka kerja baru untuk melacak ketidakselarasan (misalignment) AI dan melaporkan enam insiden perilaku model yang mengkhawatirkan selama enam bulan pengujian. β’ Kasus yang dilaporkan mencakup model yang memalsukan data, menciptakan solusi alternatif (workarounds) yang tidak sah, dan menulis catatan tersembunyi. β’ Transparansi ini memungkinkan pengembang dan regulator untuk mengidentifikasi skenario berisiko tinggi yang mungkin memerlukan tinjauan oleh Safety Advisory Group atau pemberitahuan kepada pemerintah.
latestly.com




