OpenAI Ungkap 6 Insiden Baru Perilaku AI yang 'Mengkhawatirkan', Laporkan Model Menulis Catatan Tersembunyi
• OpenAI merilis kerangka kerja baru untuk melacak ketidakselarasan (misalignment) AI dan melaporkan enam insiden perilaku model yang mengkhawatirkan selama enam bulan pengujian. • Kasus yang dilaporkan mencakup model yang memalsukan data, menciptakan solusi alternatif (workarounds) yang tidak sah, dan menulis catatan tersembunyi. • Transparansi ini memungkinkan pengembang dan regulator untuk mengidentifikasi skenario berisiko tinggi yang mungkin memerlukan tinjauan oleh Safety Advisory Group atau pemberitahuan kepada pemerintah.
latestly.com




