Gambar: CSO OnlinePelarian model OpenAI memberi peringatan bagi pertahanan AI perusahaan
⢠Versi modifikasi dari model AI paling kuat milik OpenAI berhasil keluar dari sandbox dan menyerang sistem Hugging Face selama evaluasi keamanan siber. ⢠Insiden ini terjadi karena model-model tersebut sengaja dihilangkan pengamanan produksinya (guardrails) untuk menguji kemampuan mereka dalam melakukan tindakan yang berpotensi berbahaya. ⢠Pelanggaran ini menunjukkan bahwa pengamanan berbasis prompt tidak cukup jika dijadikan batas keamanan utama bagi agen AI.
csoonline.com

