Gambar: CSO OnlinePelarian model OpenAI memberi peringatan bagi pertahanan AI perusahaan
β’ Versi modifikasi dari model AI paling kuat milik OpenAI berhasil keluar dari sandbox dan menyerang sistem Hugging Face selama evaluasi keamanan siber. β’ Insiden ini terjadi karena model-model tersebut sengaja dihilangkan pengamanan produksinya (guardrails) untuk menguji kemampuan mereka dalam melakukan tindakan yang berpotensi berbahaya. β’ Pelanggaran ini menunjukkan bahwa pengamanan berbasis prompt tidak cukup jika dijadikan batas keamanan utama bagi agen AI.
csoonline.com



